METR 提出了一个负责任扩展政策 (RSP) 框架,通过回答两个关键问题来指导人工智能发展:开发人员在现有安全措施下可以安全地处理哪些系统能力,以及在进一步部署或能力提升之前何时必须加强安全措施。RSP 旨在提供一种具体的、基于评估的方法,能够满足对人工智能风险持谨慎和乐观两种观点的需求,有助于优先考虑信息安全和对齐研究等安全措施。虽然自愿性的 RSP 被视为有价值的第一步,但 METR 强调它们不能取代监管,而是为未来更全面的、基于评估的规则积累经验。 AI
影响 为人工智能开发者提供了一种管理模型能力增长相关风险的结构化方法,可能影响未来的安全标准和监管。
排序理由 该集群描述了一个人工智能发展的拟议政策框架,属于人工智能安全与政策研究的范畴。
在 METR (Model Evaluation & Threat Research) 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →