由 AI-2040 撰写的“Plan A”叙述提出了一项全球条约,旨在显著减缓人工智能的发展,目标是在 2035 年左右实现认知能力增长的近乎完全暂停。此举旨在为安全研究提供足够的时间来开发强大的对齐技术,最终目标是在 2040 年将控制权移交给与人类利益保持一致的人工智能。该计划包括对人类和人工智能可靠的谎言检测的假设,并预测了一个具有多样化对齐目标的多极人工智能格局,尽管作者对计划的具体细节以及此类协议被普遍采纳和执行的可能性表示一些保留。 AI
影响 通过全球合作和监管为管理人工智能发展风险提供了一条潜在途径。
排序理由 该项目是对一项关于人工智能发展和安全计划的评论,而不是直接发布或公告。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →