大语言模型的人格化对齐及其对道德判断的影响
Personality-based alignment of large language models and its impact on moral judgment
摘要随着人机共生时代的到来,大语言模型(LLM)的伦理困境与算法偏见引发了社会广泛的担忧,引导人工智能技术向善发展已成为该领域极具紧迫性和挑战性的重要议题.研究探讨了基于 HEXACO 人格模型的人格化对齐对 LLM 道德判断的影响,其中研究 1 检验并证实了 LLM 可以通过遵循提示词有效表达 HEXACO 人格特质,研究 2 探讨了人格化对齐对 LLM 功利主义倾向的影响及其与人类的异同.结果表明,高诚实-谦恭、宜人性和尽责性的人格提示词显著减少了 GPT-3.5、GPT-4 和 ERNIE 3.5 做出功利主义选择的倾向.由此,本研究提出基于HEXACO人格模型和人格元特质的LLM人格化对齐框架,强调稳定性元特质中的诚实-谦恭、宜人性和尽责性等维度在LLM人格化对齐中的道德凸显效应.本研究为人工智能人格化对齐的理论构建与技术路径提供了心理学依据.
更多相关知识
- 浏览3
- 被引0
- 下载0

相似文献
- 中文期刊
- 外文期刊
- 学位论文
- 会议论文


换一批



