Anthropic 在发布 Claude Fable 5.1 时实施了一项安全措施,阻止新的 API 用户编辑过去的对话轮次,同时保留 Claude 的内部推理。此举旨在阻止大规模模型蒸馏攻击,即竞争对手可以收集模型的思维过程来创建更便宜的副本。此外,Anthropic 还为 2026 年 8 月 2 日之后发布的模型生成文本引入了统计水印,并推出了用于检测这些水印的私有预览 API,以符合欧盟人工智能法案的透明度要求。 AI
影响 此次发布旨在保护专有模型不被复制,可能会减缓先进人工智能能力的商品化。
排序理由 Frontier-lab 模型发布,包含系统卡和新安全功能。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Anthropic
- Claude Fable 5.1
- Code of Practice on Transparency of AI-Generated Content
- EU AI Act
- Moonshot
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →