Anthropic 开发了其 Claude AI 模型的一个“不受限制”的版本,该版本可通过其网络验证计划 (Cyber Verification Program) 供经过审查的安全团队使用。这个特殊版本运行的安全防护措施大大减少,允许更开放地探索和测试 AI 的能力。该计划旨在为研究人员提供在约束较少的情况下对模型行为的更深入了解。 AI
影响 为安全研究人员提供了一个限制较少的 AI 用于测试,可能有助于改进未来模型的安全措施。
排序理由 文章讨论的是现有 AI 模型的一个用于内部测试的特殊版本,而非公开发布或重大的新功能。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →