PulseAugur
实时 20:36:01
实体 Intelligence indexes generalist genes for cognitive abilities

Intelligence indexes generalist genes for cognitive abilities

PulseAugur coverage of Intelligence indexes generalist genes for cognitive abilities — every cluster mentioning Intelligence indexes generalist genes for cognitive abilities across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. TOOL · CL_178875 ·

    DeepSeek 的 V4-Flash 模型通过再训练得分提升 10 分

    DeepSeek 的 V4-Flash 模型在 Artificial Analysis 的智能指数上获得了 50 分,标志着显著的 10 分提升。这一进步是通过在不改变模型架构的情况下进行训练后优化实现的。值得注意的是,与 GPT-5.6 Luna 相比,再训练后的模型每项任务的成本也更低,约节省 60%。

  2. SIGNIFICANT · CL_145992 ·

    Thinking Machines 的 Inkling 以 41 的智商指数得分领跑美国开源模型

    Thinking Machines 发布了 Inkling,这是一款开源人工智能模型,在智商指数中获得 41 分,使其成为美国开源模型中的佼佼者。虽然 Inkling 展示了强大的推理能力,但在基于知识的任务中,其幻觉率也高达 63%。该模型对 GPU 内存的巨大需求给潜在采用者带来了实际挑战。

  3. TOOL · CL_106338 ·

    新的智能指数对前沿人工智能模型进行排名

    Artificial Analysis 开发了一个“智能指数”来量化前沿人工智能模型的能力。该指数是九项评估的加权平均值,重点关注代理任务。虽然目前闭源模型在指数的所有三个类别中均处于领先地位,但由于缺乏对其规模和架构的透明度,比较受到限制。表现最佳的开源模型 GLM-5.2 是一个完全文档化的 753B expert 混合模型。

  4. RESEARCH · CL_94468 ·

    Artificial Analysis 更新 Intelligence Index 以评估 AI 模型 · 跟踪 2 个来源

    Artificial Analysis 发布了其 Intelligence Index 的 4.1 版本,这是一个用于评估模型智能的综合指标。此次更新更加强调代理工作负载,并纳入了改进的基准和新的特定任务指标。该指数为比较 LLM 性能和评估以代理为中心的能力提供了有价值的参考。