PulseAugur
实时 10:33:28
实体 MiMo-V2.5-Pro UltraSpeed

MiMo-V2.5-Pro UltraSpeed

PulseAugur coverage of MiMo-V2.5-Pro UltraSpeed — every cluster mentioning MiMo-V2.5-Pro UltraSpeed across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 6
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
时间线
  1. 2026-06-08 product_launch Xiaomi has launched its new MiMo-v2.5-Pro-UltraSpeed AI model. 来源
  2. 2026-06-08 product_launch Xiaomi released MiMo-V2.5-Pro-UltraSpeed, a 1-trillion-parameter AI model achieving over 1000 tokens per second on commodity GPUs. 来源
最近 · 第 1/1 页 · 共 6 条
  1. RESEARCH · CL_85493 ·

    小米MiMo Code AI代理在编码任务中击败Claude Code

    小米发布了MiMo Code,一个开源的AI编码代理,据报道在盲测中表现优于Anthropic的Claude Code。MiMo Code采用多代理方法来生成和评估任务执行步骤,提高了性能。它还包含了处理长时任务的机制,并通过从自然语言描述生成JavaScript代码来确定性地执行指令。

  2. RESEARCH · CL_79373 ·

    小米MiMo使用通用GPU将AI推理速度提升至1000 token/秒

    小米的MiMo技术团队推出了其模型推理系统的新模式MiMo-V2.5-Pro-UltraSpeed。此次升级在不损害模型能力的情况下,将推理速度显著提升至1000 token/秒。值得注意的是,它仅使用通用GPU即可实现此性能,无需定制硬件。

  3. RESEARCH · CL_81016 ·

    OpenAI提交S-1,苹果更新Siri,小米声称AI速度更快

    OpenAI已秘密向美国证券交易委员会(SEC)提交S-1文件,表明其有未来进行首次公开募股(IPO)的计划,但尚未确定时间表。苹果公司正在改进Siri,

  4. SIGNIFICANT · CL_78352 ·

    小米声称在8GPU上1T参数模型达到1000+ token/秒

    小米的MiMo团队宣布了MiMo-V2.5-Pro UltraSpeed,这是一个拥有1万亿参数的专家混合(Mixture-of-Experts)模型,能够超过每秒1000个token。这一性能是在标准的8GPU服务器上实现的,采用了FP4量化与QAT、DFlash投机解码以及TileRT延迟优化内核等技术。该公司已通过其API以高价向部分用户提供此高速模型。

  5. SIGNIFICANT · CL_78301 ·

    小米在商用GPU上实现1T参数模型每秒1000 token

    小米的MiMo团队发布了MiMo-V2.5-Pro-UltraSpeed,这是其1万亿参数模型的全新推理模式,在商用GPU上实现了超过每秒1000 token的吞吐量。这种显著的速度提升归功于FP4量化、DFlash推测解码和TileRT服务系统的结合,无需定制硬件。该公司声称,这一进步将通过实现更快的并行推理、提高编码代理效率和支持实时决策过程来彻底改变AI应用。

  6. SIGNIFICANT · CL_80536 ·

    小米发布MiMo-V2.5-Pro-FP4-DFlash以实现高效AI推理

    小米发布了MiMo-V2.5-Pro-FP4-DFlash,这是一款为高效推理而优化的新模型。它采用了专家级FP4量化,以减小内存占用和带宽压力,同时保持质量。该模型还集成了BF16 DFlash草稿器,用于推测性解码,通过每次前向传播提出token块来实现更快的token生成。