Advertisement

Exploring Multilingual Concepts of Human Values in Large Language Models

阅读量:

本篇文章属于LLM系列内容,主要涉及对《Exploring Multilingual __ Concepts of Human Values in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?》这一文献的译介工作。

在大型语言模型中探索人类价值观的多语言概念:价值取向在语言之间是一致的、可传递的和可控制的吗?

  • 摘要
    • 1 引言
    • 2 相关研究
    • 3 多语言价值观的探究
    • 4 实验分析
    • 5 Q4:大语言模型的价值对齐在不同语言环境下是否具备可调控性?
    • 6 分析与建议
    • 7 总结
    • 不足之处

摘要

已有研究显示,抽象概念在大型语言模型(LLM)的表示空间中通常以线性方向的形式呈现,且主要基于英语语料进行构建。本研究将这一发现拓展至多语言环境,尤其聚焦于与人类价值观相关的概念(即价值概念),因其对人工智能安全具有深远影响。通过对七类人类价值观、十六种语言以及三个具备不同多语能力的LLM系列进行系统性分析,我们首次以多语言实证方式确认了价值概念在LLM中的存在。进一步针对这些概念的跨语言特征展开研究后发现,由于语言资源分布不均,呈现出三种显著现象:跨语言

全部评论 (0)

还没有任何评论哟~