实体
Opus series
Opus series
PulseAugur coverage of Opus series — every cluster mentioning Opus series across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
Gemini 4 Pro 的早期评估表明其具有顶级性能和更低的幻觉率
Bindu Reddy 分享了对谷歌 Gemini 4 Pro 的早期印象,认为它有可能成为谷歌的顶级模型。初步观察强调了其在处理3D游戏方面的能力、快速的响应时间和与Opus系列相比更低的幻觉率。然而,这些见解是基于初步观察,而非官方公告或已验证的基准测试。
-
Anthropic 的新 Opus 模型在关键 AI 基准测试中超越 Fable 5
据报道,Anthropic 发布了一个新的 Opus 系列模型,该模型在 Humanity's Last Exam、agentic coding 和 ARC-AGI 等基准测试中表现优于其之前的 Fable 5 模型。这一进展表明 Anthropic 的 AI 能力取得了重大进步。用户对实现通用人工智能 (AGI) 的潜力表示乐观,并指出其他前沿模型,如 DeepMind 的 Gemini 3.1 Pro,以及即将发布的 GPT-6、…