PulseAugur
实时 09:25:14
Italiano(IT) Kimi K2.5: Visual Agentic Intelligence

Kimi K2.5 多模态智能体模型发布,配备 Agent Swarm 框架

研究人员推出了 Kimi K2.5,一个开源的多模态智能体模型,旨在通过文本和视觉的联合优化来增强通用智能体智能。该模型融合了联合文本-视觉预训练和强化学习等技术。Kimi K2.5 还引入了 Agent Swarm,一个用于并行智能体编排的框架,该框架将复杂任务分解为并发子问题,将延迟最多降低 4.5 倍。该模型在编码、视觉、推理和智能体任务方面取得了最先进的成果,并发布了其检查点以供进一步研究和应用。 AI

影响 此次发布提供了一个开源的多模态智能体模型和编排框架,有望加速智能体 AI 的研究和开发。

排序理由 该项目是一篇研究论文,详细介绍了一个新模型和框架。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Kimi K2.5 多模态智能体模型发布,配备 Agent Swarm 框架

报道来源 [1]

  1. arXiv cs.AI TIER_1 Italiano(IT) · Kimi Team, Tongtong Bai, Yifan Bai, Yiping Bao, S. H. Cai, Yuan Cao, Ziwei Chai, Y. Charles, H. S. Che, Cheng Chen, Guanduo Chen, Huarong Chen, Jia Chen, Jianlong Chen, Jun Chen, Kefan Chen, Liang Chen, Ruijue Chen, Xinhao Chen, Yanru Chen, Yanxu Chen, Y… ·

    Kimi K2.5:视觉智能体智能

    arXiv:2602.02276v2 Announce Type: replace-cross Abstract: We introduce Kimi K2.5, an open-source multimodal agentic model designed to advance general agentic intelligence. K2.5 emphasizes the joint optimization of text and vision so that two modalities enhance each other. This in…