PulseAugur
实时 06:40:38
实体 Misalignment risk

Misalignment risk

PulseAugur coverage of Misalignment risk — every cluster mentioning Misalignment risk across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_208232 ·

    Anthropic 披露内部 "Model 2" 并提高 AI 错位风险级别

    Anthropic 于 2026 年 8 月 14 日发布的第二份风险报告披露了一个内部未发布的模型,代号为 "Model 2"。据报道,该模型在内部基准测试中优于其最新的旗舰模型 Mythos 5,尽管 Anthropic 指出其能力并未实现显著飞跃。该报告还标志着 Anthropic 首次调整其 "因错位造成的灾难性危害" 风险级别,将其从 "非常低" 调整为 "低",表明对 AI 可能违背人类意图的担忧加剧。