PulseAugur
实时 07:21:20
English(EN) 📰 Latent — OpenAI's math flex, and grading your coding agent • OpenAI runs its own "find genuinely hard results" math experiment • 235 companies sign a Microsof

OpenAI 测试 AI 数学能力;235 家公司支持开放权重模型

OpenAI 进行了自己的内部实验,以识别具有挑战性的数学问题,旨在推动 AI 在该领域的极限。此外,由 Microsoft 指导的 235 家公司签署了一封信,倡导开放权重模型。Supabase 还发布了一个基准测试,用于评估 Claude CodeCodexOpenCode 等模型的编码性能。 AI

影响 强调了对 AI 编码代理进行基准测试和探索 AI 数学推理能力的持续努力,同时也预示着行业对开放权重模型(open-weight models)的支持。

排序理由 该条目是关于多项 AI 相关进展的新闻摘要,包括 OpenAI 的内部实验和关于开放权重模型的信函,而不是主要发布或重要的行业事件。

在 Mastodon — fosstodon.org 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

OpenAI 测试 AI 数学能力;235 家公司支持开放权重模型

报道来源 [1]

  1. Mastodon — fosstodon.org TIER_1 English(EN) · [email protected] ·

    📰 Latent — OpenAI 的数学展示,以及对你的编码代理进行评分 • OpenAI 进行了自己的“寻找真正困难结果”数学实验 • 235 家公司签署了微软

    📰 Latent — OpenAI's math flex, and grading your coding agent • OpenAI runs its own "find genuinely hard results" math experiment • 235 companies sign a Microsoft-shepherded open-weights letter • Supabase open-sources a benchmark that grades Claude Code, Codex and OpenCode • AMD s…