OpenAI 已经解决了某些安全测试结果下降的担忧,并将其归因于测量误差。该公司表示,情感依赖性测试可能对常用昵称反应过度,而青少年分类器屏蔽并未准确反映在结果中。未来模型更新或澄清是否能解决安全类别中已记录的这些回归,仍有待观察。 AI
影响 OpenAI 对安全测试差异的解释可能会影响对人工智能安全基准的解读和完善方式。
排序理由 该条目讨论的是公司对测试结果的解释,而不是新发布或研究。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →