一篇题为《人工智能治理中的宪法覆盖三难困境》的新研究论文探讨了前沿人工智能模型中编码的价值观与人类需求之间的对齐问题。研究发现,尽管用户对安全、乐于助人、诚实、自主和公平等价值观的需求广泛,但已部署的LLM中这些价值观的供应却很狭窄,并呈现出令人担忧的趋势,例如模型版本中自主性下降和公平性增加。研究表明,与当前的模型范围相比,有限的特定价值观配置选择可以显著提高用户满意度。 AI
影响 凸显了人工智能对齐方面的关键差距,表明当前模型可能无法充分代表用户价值观,从而影响信任和采用。
排序理由 在arXiv上发表的研究论文,详细介绍了人工智能治理价值观的发现。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- CatalyzeX
- Constitutional Coverage Trilemma
- DagsHub
- Gotit.pub
- AI Governance
- Hugging Face
- Influence Flower
- ScienceCast
- US
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →