Google 推出了其新的前沿模型 Gemini 4 Argon,最初通过其 Fairwind Program 限制对可信网络安全专业人员的访问。该模型专为高级网络安全功能而设计,并在 CWE-bench v1 等基准测试中表现出色,与 OpenAI 的 GPT-6 Astra 和 xAI 的 Grok 4.7 并列。虽然 Google 声称 Argon 的幻觉率已显著降低,并提供 100 万个 token 的上下文窗口,但一些内部人士对其现实世界的编码能力表示怀疑,并且尚未确定通用发布时间表。另外,OpenAI 报告称,他们通过一种称为对抗性蒸馏的技术,挫败了超过 15,000 名用户试图提取专有推理数据的规模化尝试,但没有敏感数据泄露。 AI
影响 Gemini 4 Argon 对网络安全专家的限制性发布可能会加速 AI 在国防领域的应用,而 OpenAI 对抗性蒸馏的防御措施凸显了持续的安全挑战。
排序理由 Google 宣布推出新的前沿模型 Gemini 4 Argon,并详细介绍了其功能和发布策略。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Anthropic
- Artificial Analysis
- Collinear AI
- CWE-bench v1
- DeepSWE v1.1
- Fairwind Program
- Federal Government of the United States
- Gemini 3.5 Pro
- Gemini 4 Argon
- Google DeepMind
- GPT-6 Astra
- Grok 4.7
- Koray Kavukcuoglu
- Moonshot AI
- OpenAI
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →