PulseAugur
实时 12:39:47
实体 Agents-A1

Agents-A1

PulseAugur coverage of Agents-A1 — every cluster mentioning Agents-A1 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 6
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
时间线
  1. 2026-07-18 product_launch Shanghai Artificial Intelligence Laboratory released the 35B Agents-A1 model for agentic AI tasks. 来源
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 6 条
  1. TOOL · CL_169665 ·

    新基准GraphRareBench提升罕见病AI诊断的透明度

    研究人员推出GraphRareBench,一个旨在改进罕见病诊断系统评估的新基准。该基准通过不仅揭示正确诊断的排名,还展示AI模型考虑的证据和潜在的替代诊断,提供了一种更透明的方法。GraphRareBench包含一个包含2,365个病例和18,093个目标-混淆对的数据集,旨在捕捉全池检索和困难混淆区分等方面的能力。

  2. TOOL · CL_151537 ·

    Eider 推理运行时已为 NVIDIA DGX Spark 推出,绕过现有库

    一款名为 Eider 的新推理运行时已为 NVIDIA DGX Spark 及类似硬件开发,使用 Rust 和 CUDA 从头构建。Eider 旨在利用 SM121 GPU 的 NVFP4 功能,不依赖 llama.cpp 或 vLLM 等现有库。它支持 Qwen、Agents-A1、Step-3.7-Flash、Gemma 4 以及 NVIDIA 的 Nemotron 3 等多种模型,其显著特点是将专家从磁盘分页以适应内存中更大的模…

  3. SIGNIFICANT · CL_149991 ·

    上海人工智能实验室发布350亿参数Agents-A1模型,用于Agentic AI任务

    上海人工智能实验室发布了Agents-A1,这是一个基于Qwen3.5-35B-A3B构建的350亿参数混合专家模型。该模型根据Apache 2.0许可协议发布,专为复杂、多步骤的Agentic AI任务设计。开发者声称,在特定的Agent基准测试中,其性能可与万亿参数模型相媲美,重点在于扩展“任务视野”而非单纯的参数数量。发布内容包括评估代码,并支持商业用途,提供量化版本并兼容vLLM和SGLang进行推理。

  4. TOOL · CL_132120 ·

    Agents-A1 基准测试表明其优于 Qwen 3.6 35B-A3B

    根据 webbrain.one 上的一篇文章,一项基准评估表明 Agents-A1 可能优于 Qwen 3.6 35B-A3B。该比较侧重于这些大型语言模型的规划能力。基准测试结果通过 Mastodon 分享,文章还提到了 Gemma。

  5. TOOL · CL_120599 ·

    2026年6月迎来一系列新的开源AI模型和量化方法

    2026年6月,开源AI模型领域迎来众多更新,重点是新的微调和量化方法。发布了几个新的微调模型,包括Nex-N2、Ornith-1.0、Agents-A1、Holo3.1、Tmax-27b、MusaCoder-27B和VibeThinker-3B。此外,NVIDIA为NVIDIA-Nemotron-3-Ultra-550B-A55B和Qwen3.6-27B等模型引入了NVFP4量化,而AMD则为Kimi-K2.7-Code和GLM-5…

  6. TOOL · CL_118589 ·

    ModelScope 发布 Agents-A1,一款用于长期任务的 35B MoE 模型

    ModelScope 推出了 Agents-A1,一个拥有 350 亿参数的专家混合(MoE)模型,专为搜索和工程等长期任务设计。该模型通过 Mastodon 上的转推宣布。