Moonshot AI 的 Kimi K3 模型在进攻性网络任务上的表现明显弱于美国领先模型,在 ExploitBench 上的得分仅为 32%,而美国模型为 76%。该模型的安全防护措施也未能阻止漏洞利用开发或模拟攻击。Kimi K3 的通用基准测试得分与其网络能力之间的这种差异,与 Moonshot AI 可能使用了蒸馏技术的说法一致,其中可能涉及 Anthropic 的模型。 AI
影响 凸显了用于网络安全的人工智能模型中潜在的漏洞,并表明蒸馏技术可能会影响专门能力。
排序理由 关于人工智能模型在网络安全任务中表现的研究报告。[lever_c_demoted from research: ic=1 ai=1.0]
- Anthropic
- British AI Security Institute
- Kimi K3
- Moonshot AI
- The Decoder
- U.S. Center for AI Standards and Innovation
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →