实体
Responsible Scaling Policy
Responsible Scaling Policy
PulseAugur coverage of Responsible Scaling Policy — every cluster mentioning Responsible Scaling Policy across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
-
Anthropic 披露内部 "Model 2" 并提高 AI 错位风险级别
Anthropic 于 2026 年 8 月 14 日发布的第二份风险报告披露了一个内部未发布的模型,代号为 "Model 2"。据报道,该模型在内部基准测试中优于其最新的旗舰模型 Mythos 5,尽管 Anthropic 指出其能力并未实现显著飞跃。该报告还标志着 Anthropic 首次调整其 "因错位造成的灾难性危害" 风险级别,将其从 "非常低" 调整为 "低",表明对 AI 可能违背人类意图的担忧加剧。
-
Anthropic 发布第二份人工智能风险报告
Anthropic 发布了其第二份风险报告,详细说明了其人工智能系统相关的潜在风险以及其管理这些风险的准备情况。本报告是我们公司通过负责任扩展政策持续致力于透明度的一部分。该报告现已公开发布。
-
METR 提出人工智能发展的负责任扩展政策
METR 提出了一个负责任扩展政策 (RSP) 框架,通过回答两个关键问题来指导人工智能发展:开发人员在现有安全措施下可以安全地处理哪些系统能力,以及在进一步部署或能力提升之前何时必须加强安全措施。RSP 旨在提供一种具体的、基于评估的方法,能够满足对人工智能风险持谨慎和乐观两种观点的需求,有助于优先考虑信息安全和对齐研究等安全措施。虽然自愿性的 RSP 被视为有价值的第一步,但 METR 强调它们不能取代监管,而是为未来更全面的、基…