Sangfor AI 在 CyberGym AI 安全能力基准测试中取得了全球前四名和中国第一名的成绩。利用 GLM-5.2 基础模型,Sangfor AI 成功完成了 1507 项任务中的 1301 项,在应对全面的 ARVO 和 OSS-Fuzz 漏洞挑战时成功率达到 86.3%。这一表现凸显了国内 AI 模型在专业安全评估中的日益增强的实力。 AI
影响 展示了 AI 安全能力的进步,特别是国内基础模型的进步。
排序理由 在专业 AI 安全基准测试中的表现。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →