一篇新论文认为,将AI系统与人类道德对齐的过程由于开发者的选择而存在固有的偏见。研究强调,在特征选择、投票者抽样和问题措辞方面的决策会显著影响AI最终的道德偏好。这些通常未被记录的选择会影响AI肾脏分配、模拟缺勤员工的AI代理以及已故人士的生成式AI描绘等关键应用的最终结果,表明仅靠当前的聚合方法无法确保AI的公平或透明。 AI
影响 强调了AI对齐中开发者的决策如何引入偏见,影响关键应用的公平性和透明度。
排序理由 学术论文发表在arXiv上,讨论AI伦理和对齐。[lever_c_demoted from research: ic=1 ai=1.0]
- AI agents simulating absent workers
- AI kidney allocation
- alphaXiv
- CatalyzeX Code Finder for Papers
- DagsHub
- Edyta Paulina Bogucka
- generative AI depictions of the deceased
- Gotit.pub
- Hugging Face
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →