实体
Terminal Bench 3.0
Terminal Bench 3.0
PulseAugur coverage of Terminal Bench 3.0 — every cluster mentioning Terminal Bench 3.0 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
Zhipu AI 发布 GLM-5.3,在编码和安全基准测试中表现出色
Zhipu AI 发布了其新模型 GLM-5.3,该模型专为编码和安全任务设计。该模型在基准测试中的性能显著提高,在 SWE-Marathon 上的得分翻了一番多,在 Terminal Bench 3.0 上的得分翻了五倍。GLM-5.3 在 CyberGym 基准测试中也取得了最高分。
-
智谱AI发布GLM-5.3,声称拥有最强的开源编码模型
智谱AI发布了GLM-5.3,这是一款开源编码模型,据称在性能上比前代GLM-5.2有了显著提升。这种提升归功于广泛的后训练扩展,而非基础模型的改动。GLM-5.3在复杂编码任务,特别是长时域任务上表现出增强的性能,并在网络安全应用中取得了显著成功,识别出大量漏洞。