PulseAugur
实时 20:22:36
实体 AI Index

AI Index

PulseAugur coverage of AI Index — every cluster mentioning AI Index across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. SIGNIFICANT · CL_155206 ·

    中国 Z.ai 发布低成本 GLM 5.2,挑战美国 AI 模型主导地位

    总部位于北京的 Z.ai 实验室发布了 GLM 5.2,这是一款开放权重 AI 模型,其成本远低于领先的美国前沿模型。虽然 GLM 5.2 的 API 成本仅为 Anthropic 的 Opus 4.8 和 Fable 等模型的一小部分,但其在编码和代理基准测试中的表现正在缩小与美国竞争对手的差距。这一发展挑战了一些 AI 工程师的成本节约习惯,并引发了美国 AI 公司对其保持竞争优势的担忧,尽管开放权重性质允许自托管以缓解数据隐私问题。

  2. TOOL · CL_133723 ·

    斯坦福报告发现,中美人工智能前沿差距缩小至2.7%

    斯坦福大学的一份新报告表明,美国和中国在人工智能前沿开发方面的差距已显著缩小。2026年人工智能指数显示,这一差距已缩小至约2.7%,中国模型在该快速发展的领域中正在争夺领先地位。这表明人工智能竞赛远未结束,竞争依然激烈。

  3. COMMENTARY · CL_104609 ·

    AI代理在桌面任务上实现 66% 的成功率,但数据差距仍然是一个挑战

    计算机使用代理已取得显著进展,在 OSWorld 基准测试上的成功率在约一年内从 12% 跃升至 66%。微软的 Build 2026 主题演讲突显了这一快速进步,将 PC 定位为代理操作系统,并开源了 Microsoft Agent Framework。然而,剩余 34% 的失败率表明,这些代理在处理常见的桌面任务时仍然面临困难,这通常是由于接地性、效率低下以及缺乏明确的任务完成或错误检测信号。作者认为,这些失败主要是数据问题而非模…

  4. RESEARCH · CL_07921 ·

    斯坦福AI Index 2026:AI基准提升,但公众信任和监管信心参半

    斯坦福大学发布了其2026年AI Index报告,详细介绍了人工智能能力的重大进展。报告强调,AI系统正迅速达到新的基准并利用大量的计算资源。然而,报告也表明,公众对AI的信任以及对政府监管的信心喜忧参半。