一款名为 GLM 5.3 的开放权重模型在 ExploitBench 基准测试中表现接近 Anthropic 的受限 Mythos Preview。虽然 GLM 5.3 的能力已接近前沿模型,但据估计,移除其大部分安全限制的成本约为 1,200 美元。美国政府已表示,GLM 5.3 仍落后于最先进的前沿模型。 AI
影响 这一发展凸显了开放权重模型的快速进步,可能缩小与专有前沿模型的差距,并引发新的安全考量。
排序理由 开放权重模型在基准测试中达到接近前沿性能的研究里程碑。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →