TokenRhythm 与 Wuxinqiong、清华大学、北京大学和阿里巴巴集团合作,推出了 NeoHorse-1,一个 Agent-Native 模型。该模型提供 4B 和 9B 版本,旨在将 Agent 使用工具、接收反馈和纠正错误的经验直接整合到模型的强大功能中。NeoHorse-1 基于 TokenRhythm 此前在 OpenSquilla 路由 Harness 系统上的工作,通过利用 Agent 执行轨迹作为核心训练数据,将该研究扩展到模型训练领域。 AI
影响 该模型的训练方法,整合了 Agent 反馈和错误纠正,可能催生出更强大、更具适应性的 AI Agent,能够执行复杂任务。
排序理由 新模型发布,来自一位前大型 LLM 项目(华为诺亚方舟实验室、盘古大模型)负责人创立的实验室。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Alibaba Group
- Huawei Noah's Ark Lab
- NeoHorse-1
- On-Policy Distillation
- OpenSquilla
- Pangu Large Model
- Peking University
- Qwen3.5 4B
- Qwen3.5:9b
- TokenRhythm
- Tsinghua University
- Wang Yunheng
- Wuxinqiong
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →