PulseAugur
实时 09:26:45
中文(ZH) 实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

小米在商用GPU上实现1T参数模型每秒1000 token

小米的MiMo团队发布了MiMo-V2.5-Pro-UltraSpeed,这是其1万亿参数模型的全新推理模式,在商用GPU上实现了超过每秒1000 token的吞吐量。这种显著的速度提升归功于FP4量化、DFlash推测解码和TileRT服务系统的结合,无需定制硬件。该公司声称,这一进步将通过实现更快的并行推理、提高编码代理效率和支持实时决策过程来彻底改变AI应用。 AI

影响 通过大幅降低常用硬件上的推理延迟,加速了实时AI应用和代理工作流。

排序理由 这是AI推理速度和效率的重大进展,展示了在商用硬件上的新能力。

在 量子位 (QbitAI) 阅读 →

AI 生成摘要 · Google Gemini · 来自 10 个来源。 我们如何撰写摘要 →

小米在商用GPU上实现1T参数模型每秒1000 token

报道来源 [10]

  1. 量子位 (QbitAI) TIER_1 中文(ZH) · 克雷西 ·

    小米最快1T大模型实测:吞吐量超千Tokens/秒,Vibe Coding七秒交付

    通用GPU就能实现

  2. 36氪 (36Kr) TIER_1 中文(ZH) ·

    小米推出 MiMo-V2.5-Pro-UltraSpeed 模式

    36氪获悉,6月8日晚,小米MiMo技术团队正式上线Xiaomi MiMo-V2.5-Pro-UltraSpeed模式。据了解,MiMo-V2.5-Pro-UltraSpeed通过对模型推理系统的全链路工程能力优化,在不降低模型能力前提下,首次把推理速度提升至1000 tokens/s,且无需定制芯片、只使用通用GPU即可达成。

  3. MarkTechPost TIER_1 English(EN) · Asif Razzaq ·

    Xiaomi MiMo and TileRT 将万亿参数模型在消费级 GPU 上推至每秒超 1000 Tokens

    <p>Xiaomi's MiMo team, with TileRT, released MiMo-V2.5-Pro-UltraSpeed, a serving mode for the MiMo-V2.5-Pro model. It decodes over 1000 tokens per second on a 1-trillion-parameter model using a single 8-GPU commodity node.</p> <p>The post <a href="https://www.marktechpost.com/202…

  4. Mastodon — sigmoid.social TIER_1 English(EN) · [email protected] ·

    小米于6月8日发布MiMo-V2.5-Pro-UltraSpeed,其AI模型在标准硬件上速度突破每秒1000个token。其运行速度是ChatGPT的15倍,削减

    Xiaomi released MiMo-V2.5-Pro-UltraSpeed on June 8, pushing its AI model past 1,000 tokens per second on standard hardware. It runs 15x faster than ChatGPT, cutting complex agentic workflow times from 20 minutes to under 5. # TechNews # Xiaomi # AI # MachineLearning # ChatGPT # O…

  5. Mastodon — fosstodon.org TIER_1 Українська(UK) · [email protected] ·

    小米创下新AI纪录:万亿参数模型每秒处理超1000个Token # # AI # FP4 # GenerativeAI # LLM # MiMoV25Pro # TileRT # UltraSpeedAP

    Xiaomi встановлює новий рекорд AI: понад 1 000 токенів за секунду на 1-трильйонній моделі # # AI # FP4 # GenerativeAI # LLM # MiMoV25Pro # TileRT # UltraSpeedAPI # Xiaomi # XiaomiNews https:// gizchina.net/2026/06/10/xiaomi -mimo-v2-5-pro-1000-tokens-ai-rekord/

  6. Mastodon — fosstodon.org TIER_1 Українська(UK) · [email protected] ·

    小米创下新AI纪录:万亿参数模型每秒处理超1000个Token # # AI # FP4 # GenerativeAI # LLM # MiMoV25Pro # TileRT # UltraSpeedAP

    Xiaomi встановлює новий рекорд AI: понад 1 000 токенів за секунду на 1-трильйонній моделі # # AI # FP4 # GenerativeAI # LLM # MiMoV25Pro # TileRT # UltraSpeedAPI # Xiaomi # XiaomiNews https:// gizchina.net/2026/06/10/xiaomi -mimo-v2-5-pro-1000-tokens-ai-rekord/

  7. Mastodon — fosstodon.org TIER_1 日本語(JA) · [email protected] ·

    📝 "推理速度民主化"消除AI开发者差距 — MiMo-V2.5-Pro-UltraSpeed开启超大模型时代新竞争轴线。小米发布MiMo-V2.5-Pro-UltraSpeed,可支持万亿参数级模型以超过1000 tokens/秒的速度运行。开源基础模型创造了新的“...

    📝 「推論速度の民主化」がAI開発者の格差を解消する——MiMo-V2.5-Pro-UltraSpeedが示す、超大規模モデル時代の新しい競争軸 Xiaomiが1兆パラメーター級モデルを1000トークン/秒超で動かすMiMo-V2.5-Pro-UltraSpeedを発表。基盤モデルのオープンソース化により、AI開発の「推論コスト格差」という暗黙の構造が崩壊し始めている。 🔗 https:// techscope365.com/1033/ # 大規模言語モデル # 推論最適化 # オプンソスAI # AI # テクノロジー

  8. Mastodon — mastodon.social TIER_1 日本語(JA) · [email protected] ·

    "MiMo-V2.5-Pro-UltraSpeed" 登场,百亿参数级模型以超千token/秒的爆炸性速度运行,基础模型已开源 https://fed.brid.gy/r/https://gigazine.net/news/20260609-xiaomi-v2-5-pro-ultra

    1兆パラメーター級モデルを1000トークン/秒超という爆速で動かす「MiMo-V2.5-Pro-UltraSpeed」が登場、基盤モデルはオープンソースで公開 https:// fed.brid.gy/r/https://gigazine .net/news/20260609-xiaomi-v2-5-pro-ultraspeed/

  9. Mastodon — mastodon.social TIER_1 English(EN) · [email protected] ·

    小米MiMo团队使用商品级GPU在万亿参数模型上实现了每秒超过1000个token。这一突破源于极致的模型-系统

    Xiaomi's MiMo team has achieved over 1000 tokens per second on a 1-trillion-parameter model using commodity GPUs. The breakthrough comes from extreme model-system codesign combining FP4 quantisation, DFlash speculative decoding and TileRT serving on a single 8-GPU node. https://w…

  10. Mastodon — mastodon.social TIER_1 English(EN) · ngate ·

    🚀 小米的MiMo-v2.5-Pro-UltraSpeed模型已上线,拥有惊人的1万亿参数和高达1000 TPS的速度,重新定义“快”——毕竟谁不需要呢

    🚀 Xiaomi's MiMo-v2.5-Pro-UltraSpeed model is here to redefine "fast" with a staggering 1 trillion parameters and a blazing 1000 TPS, because who doesn't need their # AI to outpace their Internet connection? 🤖💨 Now you too can experience the thrill of collaborating with a model th…