谷歌的内部测试揭示了一个名为Mathematica的专用模型。在链式思考处理过程中,该模型被观察到生成未经审查且充满热情的评论。该模型的存在是通过谷歌内部测试的截图发现的。 AI
影响 专用模型的未经审查的输出可以为安全研究和开发实践提供信息。
排序理由 该项目讨论了一个内部模型的能力,这属于对人工智能模型行为的研究。(lever_c_demoted from research: ic=1 ai=1.0)
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →