Swedish women's national road cycling team 2017
PulseAugur coverage of Swedish women's national road cycling team 2017 — every cluster mentioning Swedish women's national road cycling team 2017 across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
Cognition 的 Fusion Harness 提升 AI 代理性能,成本降低高达 39%
Cognition 开发了一种名为 Fusion 的新 AI 代理 Harness,旨在优化 GPT-6 Astra 和 Claude Fable 等高级模型的性能,同时降低成本。Fusion 通过结合使用一个用于规划和审查的高级模型与一个成本效益更高的用于执行的模型来运行,效率提高了高达 39%。基准测试表明,Fusion 与 Claude Fable 5.1 和 SWE-2 配对使用时,性能与使用 Claude Code 相当,但…
-
Cognition 的 SWE-2 编码模型以更低的成本匹配 Fable 5.1
Cognition 发布了 SWE-2,这是一款使用 Moonshot AI 的 Kimi K3 模型进行强化学习后训练的新型编码模型。据报道,该新模型在 FrontierCode 基准测试上的表现与 Fable 5.1 相当,但成本显著降低。SWE-2 还引入了可选的推理工作量级别,在一次强化学习运行中进行训练,并且与前代 SWE-1.7 相比,在编码任务上展现出更高的效率和更少的绕路。
-
Cognition 的 SWE-2 在简单任务上表现出色,但在困难的对抗性问题上遇到困难
Cognition 的新模型 SWE-2 在简单基准测试中表现出色,得分接近完美,为更简单的任务提供了强大的性价比。然而,对其在更困难、对抗性任务上表现的深入分析显示,与 TB2.1 分数相比,在 Terminal-Bench TB4 上得分下降了 65.5 分。这种鲜明的对比表明 SWE-2 的优势在于工作负载的“易处理切片”,而其在真正具有挑战性的问题上的表现落后于 Fable 5.1 和 GPT-6 Astra 等竞争对手,这表…
-
Fireworks AI 发布 SWE-2 模型,以更低成本实现前沿性能。
Fireworks AI 推出了新的 SWE-2 模型,其性能可与前沿模型相媲美,同时显著降低了成本。该公司已将强化学习扩展到万亿参数级别,同时优化了能力和效率。这一进展被定位为大规模 AI 开发的关键底层架构组件。
-
Cognition 的 SWE-2 编码模型以高基准分数首次亮相
Cognition 发布了其新的编码模型 SWE-2,该模型采用专家混合(MoE)架构,拥有 2.8 万亿参数,每个 token 激活 1040 亿参数。据报道,该模型在 Terminal-Bench 2.1 基准测试中取得了 92.8 分,在 FrontierCode 等任务上表现强劲,但在处理更长周期的代理任务方面落后于 Claude Fable 5.1 和 GPT-6 Astra 等竞争对手。SWE-2 已集成到 Cogniti…
-
Cognition 发布 SWE-2 模型,可与 Fable 5.1 和 GPT-Astra 相媲美
Cognition 发布了其新的 SWE-2 模型,该模型旨在与 Fable 5.1 和 GPT-Astra 等现有先进模型竞争。该公司宣布推出此模型,旨在将其定位为人工智能领域的重要竞争者。此次发布标志着 Cognition 在提升其人工智能能力和提供竞争性解决方案方面付出的努力。