MiMo-V2.5
PulseAugur coverage of MiMo-V2.5 — every cluster mentioning MiMo-V2.5 across labs, papers, and developer communities, ranked by signal.
- developed MiMo v2.5-Pro 95%
- instance of MiMo v2.5-Pro 90%
- instance of MIMO 90%
- developed MiMo-7B 90%
- developed by MiMo-7B 90%
- competes with MiMo v2.5-Pro 70%
- competes with TokenPapa 70%
- competes with Claude Fable-5 70%
- competes with Kimi k3 70%
- competes with MIMO 70%
- competes with GPT-5.6 70%
- competes with GPT 5.6 Luna 60%
- 2026-08-06 research_milestone MiMo-V2.5 demonstrated superior intelligence compared to Claude 4 Sonnet. 来源
- 2026-07-28 product_launch Xiaomi released its native omnimodal model, MiMo-V2.5. 来源
- 2026-07-07 product_launch Xiaomi released MiMo v2.5, focusing on inference optimization. 来源
- 2026-05-31 product_launch Xiaomi's MiMo team revealed the technical innovations enabling price reductions for their MiMo-V2.5 large model API. 来源
- 2026-05-26 product_launch Xiaomi announced a significant price reduction for its MiMo-V2.5 AI model's API. 来源
2 天有情绪数据
MiMo-V2.5 Pro demonstrates strong cost-performance in coding benchmarks
Recent analysis of the DeepSWE benchmark indicates that MiMo-V2.5 Pro offers a cost-effective solution for coding tasks, especially when compared to models like GPT 5.5. This suggests that Xiaomi's technical advancements in areas like KVCache optimization and distributed caching are translating into tangible benefits for users focused on budget-conscious performance.
Xiaomi's 'Trillion Token Creator Incentive Plan' may boost MiMo-V2.5 adoption
The extensive distribution of over 100 trillion free tokens through Xiaomi's incentive plan suggests a strategic effort to onboard developers and users onto the MiMo-V2.5 platform. This could lead to increased usage, further fine-tuning, and a broader ecosystem around MiMo models in the coming months.
MiMo-V2.5's technical breakthroughs enable profitability despite price cuts
Xiaomi has detailed five key technical advancements in MiMo-V2.5, including dual-pool KVCache and GCache distributed caching, which have allowed them to reduce API prices while maintaining profitability. This highlights a successful engineering effort to optimize inference efficiency and cost management.
-
大型语言模型推理输出各不相同,影响计费和可审计性
本文探讨了不同的 LLM 如何处理和暴露其推理过程,这会影响用户计费和可审计性。文章详细介绍了四种不同的方法:共享预算(推理与答案共享令牌限制)、推理的独立字段、启用推理输出的显式标志,以及将推理融合到内容中的模型。作者强调了潜在的陷阱,例如表现为端点故障的预算陷阱,以及理解特定 API 合约的重要性,尤其是在使用网关或翻译通道时,而不仅仅是模型名称。
-
小米发布万亿参数MiMo大模型家族,权重开放
小米发布了其MiMo大语言模型家族,最新版本MiMo-V2.5-Pro拥有万亿参数。这些模型以其MIT许可下的开放权重状态和原生的全模态能力而闻名,能够处理文本、图像、视频和音频。MiMo-V2.5-Pro采用了稀疏专家混合架构,在总计1.02万亿参数中,每个token有420亿活跃参数,并支持高达100万token的上下文窗口。
-
小米将AI融入其芯片到智能家居的整个生态系统
小米正将自身定位为实体AI领域的领导者,整合其庞大的设备生态系统和制造能力,以弥合数字模型与现实世界互动之间的差距。该公司在IFA 2025上展示了其进展,重点介绍了其HyperConnect系统以及O100和D100等新芯片如何实现其广泛的物联网网络、智能手机和汽车之间的智能协作。通过利用自有工厂进行数据收集和模型训练,小米旨在创建一个闭环系统以实现持续的AI改进,从而区别于那些只专注于模型或硬件的竞争对手。
-
Groq 对决 TokenPAPA:LLM API 的速度与成本之争
本文将 Groq 和 TokenPAPA 作为 LLM API 提供商进行比较,突出了它们各自的优势。Groq 在 Llama 等开源西方模型的低延迟和高吞吐量方面表现出色,非常适合对速度要求至关重要的面向用户的应用程序。另一方面,TokenPAPA 则专注于成本效益,以显著更低的价格提供对包括 DeepSeek V4 Flash 在内的多种模型(包括中文模型)的访问。TokenPAPA 还提供自动上下文缓存等功能以进一步降低成本,并…
-
Together AI 对决 TokenPAPA:高端基础设施 vs. 预算型 LLM 聚合
Together AI 和 TokenPAPA 服务于 AI 市场的不同细分领域,Together AI 专注于高端基础设施、GPU 集群和企业级服务,而 TokenPAPA 通过单一 API 密钥提供超过 30 个模型的经济实惠的聚合器。TokenPAPA 在推理成本效益方面表现出色,以远低于 Together AI 的价格提供 DeepSeek V4 Flash 等模型。Together AI 的优势在于定制模型训练、微调和专用的…
-
AI智能体通过新的“工具链”演进技术得到提升 · 跟踪4个来源
两篇新的研究论文介绍了通过关注围绕核心语言模型的“工具链”来提高AI智能体性能的方法。第一篇HarnessLens使用行为感知验证来高效地演进工具链,在较低的评估预算下显示出显著的性能提升。第二篇JIT-Agent是一个可训练的模型,可以即时合成任务自适应工具链,证明工具链智能可以成为智能体能力的独立且累积的维度。
-
中国人工智能模型在用量上占据主导地位,为美国战略制造“死亡地带”
在中国OpenRouter平台上,中国人工智能模型的用量已超过美国同行,占据了超过60%的流量。尽管美国实验室在最前沿能力方面仍保持领先,但中国模型提供了显著更低的成本和更高的效率,因此被用于高用量生产工作负载。这种分化为那些既非最前沿也无成本效益的人工智能战略制造了一个“死亡地带”,可能导致美国公司尽管拥有技术领先优势,却在市场份额和开发者兴趣方面遭受损失。
-
小米在强劲财报表现中拓展至AI模型、芯片和机器人领域
小米正经历复苏,得益于2026年第二季度强劲的业绩表现,营收和利润显著增长。该公司正从其核心手机和汽车业务拓展到先进的AI领域。这包括其MiMo-V2.5 AI模型,该模型在OpenRouter上取得了顶级排名;成功量产验证了其自研的玄界芯片;并在工厂环境中部署了成功率很高的新型人形机器人。
-
OpenRouter替代品:TokenPAPA在中文大模型方面领先,Groq在速度方面领先
多个平台提供了访问大语言模型的OpenRouter替代方案,各有优势。TokenPAPA因其以有竞争力的价格访问DeepSeek V4 Flash和Mimo V2.5等中文大模型,以及简化的注册流程而受到关注。DeepInfra被认为是开源模型经济实惠的选择,而Together AI则提供更全面但价格更高的全栈解决方案,包括微调。Groq凭借其LPU硬件专注于速度,适用于延迟敏感的应用,而Fireworks AI则提供了快速服务和微调能力的结合。
-
DeepSeek V4 Flash在2026年最具成本效益的大语言模型API排名中领先
2026年,大语言模型API的格局呈现出高端模型和高性价比模型之间显著的价格差异,其中一些模型每100万个token的运行成本约为0.14美元。文章根据成本效益对15个大语言模型API进行了排名,并强调最便宜的选择并不总是最具价值,因为输出质量和隐藏成本等因素也会影响其价值。DeepSeek V4 Flash被强调为最具成本效益的顶级模型,以远低于Claude Opus 4等高端模型的价格提供了接近前沿的质量,而Mimo V2.5则被…
-
LLM 爱好者就本地推理的 128GB 与 256GB 内存展开辩论
r/LocalLLaMA 子版块上的一场讨论,探讨了在搭配大量 VRAM 时,系统内存容量的最佳选择,特别是考虑 128GB 与 256GB 的对比。用户正在权衡运行各种大型语言模型(如 Deepseek v4 和 MiMo v2.5)在不同量化级别和 VRAM/内存权重分配下的取舍。对话强调了模型大小、上下文窗口和量化如何影响本地 AI 推理的内存需求。
-
Mimo v2.5 LLM 在智能测试中超越 Claude 4 Sonnet
Mimo v2.5 大型语言模型拥有 3100 亿参数,在智能方面表现优于 Claude 4 Sonnet。作者拥有丰富的 Claude 4 Sonnet 使用经验,指出 Mimo v2.5 的表现甚至超越了去年的顶级模型。这一进展表明 LLM 能力正在快速发展,较新、较小的模型正在超越已有的模型。
-
中国AI模型主导OpenRouter使用,Xiaomi和DeepSeek领跑
OpenRouter的最新报告显示,中国AI模型在该平台上的使用量占据主导地位,其中Xiaomi的MiMo-V2.5位居榜首。DeepSeek模型也表现突出,提供了与顶级闭源模型相媲美的多种能力。腾讯的Hunyuan 3最近开源后,使用量呈爆炸式增长,表明这些强大的新模型正在被迅速采用。
-
中国AI模型在OpenRouter平台上占据全球API调用量榜首
根据最新报告,中国AI模型在OpenRouter平台的全球API调用量中占据了前五名。小米的MiMo-V2.5以每周处理10.5万亿个token位居榜首,增长了12%。DeepSeek的模型占据了第二和第五位,为开发者提供了多种能力,其Pro版本在编码和复杂代理任务方面与国际顶级闭源模型竞争。腾讯最近开源的Hunyuan 3的增长显著,周增长率超过999%,位列第三。
-
像“MiMo”这样的模糊 API 请求需要结构化识别,以防止集成错误
文章讨论了当单个名称(如“MiMo”)可以指代多个不相关的产品时,API 请求的模糊性。它强调了一个常见的接收流程错误,即模糊地请求“MiMo AI API”被错误地视为一个完整的技术要求,导致在错误的服务上进行集成工作。作者提出了一个包含七个字段的结构化接收卡——名称、域、所有者、目的、文档、端点和状态——以清晰地识别正确的产品并防止浪费精力。
-
OpenRouter 凸显全球人工智能竞赛,中国模型的成本效益
OpenRouter,一个美国人工智能平台,凸显了人工智能发展的全球格局和采用情况。该平台指出,虽然各国可能试图阻止人工智能发展,但这可能导致经济劣势。OpenRouter 的用户基础以美国为主,但中国的人工智能模型因其成本效益而日益受到欢迎,例如 Mimo v2.5 等模型在性能上已接近 Claude Sonnet 5 等成熟模型。强大的 AI 模型的可访问性越来越高,可能在个人电脑上运行,这表明未来人工智能的采用对于保持竞争力至关重要。
-
Inkling 多模态模型集成到 Hugging Face、vLLM;llama.cpp 添加音频输入
顶级国际象棋引擎 Stockfish 18 的最新版本与开源 AI 领域的重大进展同时发布。Hugging Face Transformers v5.14.0 和 vLLM v0.26.0 集成了新的 Inkling 多模态模型,这是一个来自 Thinking Machines 的 9750 亿参数模型,使开发人员能够轻松地将其用于各种任务。同时,llama.cpp 的 b10155 更新增加了对 MiMo-V2.5 音频输入和基于 …
-
中国引领全球 LLM 调用量,小米 MiMo-V2.5 登顶 Token 使用量
截至 2026 年 7 月,中国已成为全球大型语言模型 (LLM) 调用量的主要力量,占总量的 63.5%,而美国占 35.5%。小米的 MiMo-V2.5 模型已显著超越所有其他模型,在 OpenRouter 平台上的周度和月度 Token 使用量方面均处于领先地位。中国 LLM 活动的激增凸显了全球人工智能格局的重大转变。
-
小米发布原生全模态MiMo-V2.5模型,支持100万上下文窗口
小米发布了其MiMo-V2.5模型,该模型以其“原生全模态”架构而著称。与许多集成不同数据类型独立组件的多模态模型不同,MiMo-V2.5从一开始就被设计为一个能够同时处理文本、图像、视频和音频的统一系统。这款混合专家模型拥有约3100亿个总参数,每个token有150亿个激活参数,并支持高达100万个token的上下文窗口。
-
美团AI升级,小米模型登顶,企业AI平台上线 · 追踪1个来源
美团已全面升级其AI助手“小团子”,增强其在本地生活服务场景下的下单、预订等操作能力。小米的MiMo-V2.5模型在OpenRouter的全球使用排行榜上名列前茅,显示其采用率显著增长。此外,美团还推出了面向企业的AI Agent平台CatPaw,旨在帮助企业构建和管理AI助手以提高运营效率。