一项发表在arXiv上的新研究探讨了合成角色设定如何影响大型语言模型的意识形态表达。研究人员使用政治罗盘测试(Political Compass Test)对七个经过指令微调的模型进行了探测,发现与较小的模型(70-80亿参数)相比,较大的模型(700亿+参数)表现出更广泛的隐性意识形态覆盖范围。明确的意识形态引导显著改变了模型的响应,其中右翼威权主义提示被证明特别有效。研究还指出,角色描述中与主题相关的内容会系统性地改变意识形态输出,凸显了LLM在政治敏感环境中的可塑性。 AI
影响 揭示了LLM响应如何被角色设定所操纵,从而影响其在敏感应用中被感知的公正性和安全性。
排序理由 关于LLM行为的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →