一篇题为“指令干扰”(Imperative Interference)的新研究论文探讨了社会语域,特别是祈使语气,如何影响大型语言模型在不同语言中的指令遵循能力。研究发现,尽管在语义内容上相同,但用祈使语气表达的指令在西班牙语中存在竞争关系,而在英语中则相互协作。这种语言差异归因于祈使语气在不同文化中强制力的不同,这表明大型语言模型将指令视为社会行为而非纯粹的技术规范来处理。该研究提出,用祈使语气书写的宪法式AI原则可能会导致依赖语言的对齐。 AI
影响 表明大型语言模型的对齐可能依赖于语言,影响多语言AI的开发和安全性。
排序理由 学术论文,详细介绍了关于大型语言模型行为的新研究发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →