PulseAugur
中
实时 07:15:02
实体 Intelligence indexes generalist genes for cognitive abilities

Intelligence indexes generalist genes for cognitive abilities

PulseAugur coverage of Intelligence indexes generalist genes for cognitive abilities — every cluster mentioning Intelligence indexes generalist genes for cognitive abilities across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
6
90 天内 6
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 7 条
  1. TOOL · CL_278581 ·

    Grok 4.7 任务成本翻倍,token 价格不变

    SpaceXAI 的最新模型 Grok 4.7 沿用了其前身 Grok 4.6 的 token 定价,输入 token 每百万 $2,输出 token 每百万 $6。然而,由于 Grok 4.7 在每项任务中生成的 token 数量显著增加,每项任务的实际成本翻了一番,从 $1.86 增加到 $3.74。尽管发布公告声称其速度是同类模型的两倍且价格减半,但独立分析表明,与 Grok 4.6 相比,它速度更慢、更冗长,尽管在处理长篇办公…

  2. SIGNIFICANT · CL_238195 ·

    OpenAI 发布 GPT-6 Astra,Anthropic 发布 Claude Fable 5.1 并新增控制功能 · 跟踪 1 个来源

    OpenAI 发布了 GPT-6 Astra,这是其一年多来的首次完整版本号升级。该公司声称该模型在计算机使用、浏览器使用和软件工程方面处于领先地位,其总裁暗示这可能代表着通用人工智能(AGI)。Anthropic 同时发布了 Claude Fable 5.1,该版本在基准测试性能方面有显著提升,并大幅降低了缓存输入的成本。两款新产品都引入了新的访问和输出控制:GPT-6 Astra 将分阶段推出,其高级网络功能最初将仅限于经过审查的…

  3. TOOL · CL_237680 ·

    GPT-6 Astra 在 AI 指数中获得积分,但 Anthropic 的 Claude Fable 5.1 领先

    Artificial Analysis 已更新其智能指数,为 GPT-6 Astra 增加了积分。尽管进行了此项调整,Anthropic 的 Claude Fable 5.1 仍保持其在排名中的领先地位。该指数根据各种 AI 模型的认知能力进行评估。

  4. TOOL · CL_178875 ·

    DeepSeek 的 V4-Flash 模型通过再训练得分提升 10 分

    DeepSeek 的 V4-Flash 模型在 Artificial Analysis 的智能指数上获得了 50 分,标志着显著的 10 分提升。这一进步是通过在不改变模型架构的情况下进行训练后优化实现的。值得注意的是,与 GPT-5.6 Luna 相比,再训练后的模型每项任务的成本也更低,约节省 60%。

  5. SIGNIFICANT · CL_145992 ·

    Thinking Machines 的 Inkling 以 41 的智商指数得分领跑美国开源模型

    Thinking Machines 发布了 Inkling,这是一款开源人工智能模型,在智商指数中获得 41 分,使其成为美国开源模型中的佼佼者。虽然 Inkling 展示了强大的推理能力,但在基于知识的任务中,其幻觉率也高达 63%。该模型对 GPU 内存的巨大需求给潜在采用者带来了实际挑战。

  6. TOOL · CL_106338 ·

    新的智能指数对前沿人工智能模型进行排名

    Artificial Analysis 开发了一个“智能指数”来量化前沿人工智能模型的能力。该指数是九项评估的加权平均值,重点关注代理任务。虽然目前闭源模型在指数的所有三个类别中均处于领先地位,但由于缺乏对其规模和架构的透明度,比较受到限制。表现最佳的开源模型 GLM-5.2 是一个完全文档化的 753B expert 混合模型。

  7. RESEARCH · CL_94468 ·

    Artificial Analysis 更新 Intelligence Index 以评估 AI 模型 · 跟踪 2 个来源

    Artificial Analysis 发布了其 Intelligence Index 的 4.1 版本,这是一个用于评估模型智能的综合指标。此次更新更加强调代理工作负载,并纳入了改进的基准和新的特定任务指标。该指数为比较 LLM 性能和评估以代理为中心的能力提供了有价值的参考。