一篇新论文提议将信托理论应用于高级人工智能助手的开发者-用户关系。该论文认为,开发者对用户负有忠诚、审慎、诚信和坦诚的义务,类似于人类专业关系中的义务。这些义务可以为人工智能系统生成特定的对齐标准,侧重于开发者对用户的义务,而不是仅仅关注用户-人工智能互动中推广的价值观。 AI
影响 通过将人工智能对齐的基础置于开发者的义务之上,提出了一种新框架,可能影响未来的人工智能安全研究和开发实践。
排序理由 关于人工智能对齐理论的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →