Exploring Multilingual Concepts of Human Values in Large Language Models
发布时间
阅读量:
阅读量
本篇文章属于LLM系列内容,主要涉及对《Exploring Multilingual __ Concepts of Human Values in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?》这一文献的译介工作。
在大型语言模型中探索人类价值观的多语言概念:价值取向在语言之间是一致的、可传递的和可控制的吗?
- 摘要
- 1 引言
- 2 相关研究
- 3 多语言价值观的探究
- 4 实验分析
- 5 Q4:大语言模型的价值对齐在不同语言环境下是否具备可调控性?
- 6 分析与建议
- 7 总结
- 不足之处
摘要
已有研究显示,抽象概念在大型语言模型(LLM)的表示空间中通常以线性方向的形式呈现,且主要基于英语语料进行构建。本研究将这一发现拓展至多语言环境,尤其聚焦于与人类价值观相关的概念(即价值概念),因其对人工智能安全具有深远影响。通过对七类人类价值观、十六种语言以及三个具备不同多语能力的LLM系列进行系统性分析,我们首次以多语言实证方式确认了价值概念在LLM中的存在。进一步针对这些概念的跨语言特征展开研究后发现,由于语言资源分布不均,呈现出三种显著现象:跨语言
全部评论 (0)
还没有任何评论哟~
