MiMo-V2.5-Pro UltraSpeed
PulseAugur coverage of MiMo-V2.5-Pro UltraSpeed — every cluster mentioning MiMo-V2.5-Pro UltraSpeed across labs, papers, and developer communities, ranked by signal.
-
小米MiMo Code AI代理在编码任务中击败Claude Code
小米发布了MiMo Code,一个开源的AI编码代理,据报道在盲测中表现优于Anthropic的Claude Code。MiMo Code采用多代理方法来生成和评估任务执行步骤,提高了性能。它还包含了处理长时任务的机制,并通过从自然语言描述生成JavaScript代码来确定性地执行指令。
-
小米MiMo使用通用GPU将AI推理速度提升至1000 token/秒
小米的MiMo技术团队推出了其模型推理系统的新模式MiMo-V2.5-Pro-UltraSpeed。此次升级在不损害模型能力的情况下,将推理速度显著提升至1000 token/秒。值得注意的是,它仅使用通用GPU即可实现此性能,无需定制硬件。
-
OpenAI提交S-1,苹果更新Siri,小米声称AI速度更快
OpenAI已秘密向美国证券交易委员会(SEC)提交S-1文件,表明其有未来进行首次公开募股(IPO)的计划,但尚未确定时间表。苹果公司正在改进Siri,
-
小米声称在8GPU上1T参数模型达到1000+ token/秒
小米的MiMo团队宣布了MiMo-V2.5-Pro UltraSpeed,这是一个拥有1万亿参数的专家混合(Mixture-of-Experts)模型,能够超过每秒1000个token。这一性能是在标准的8GPU服务器上实现的,采用了FP4量化与QAT、DFlash投机解码以及TileRT延迟优化内核等技术。该公司已通过其API以高价向部分用户提供此高速模型。
-
小米在商用GPU上实现1T参数模型每秒1000 token
小米的MiMo团队发布了MiMo-V2.5-Pro-UltraSpeed,这是其1万亿参数模型的全新推理模式,在商用GPU上实现了超过每秒1000 token的吞吐量。这种显著的速度提升归功于FP4量化、DFlash推测解码和TileRT服务系统的结合,无需定制硬件。该公司声称,这一进步将通过实现更快的并行推理、提高编码代理效率和支持实时决策过程来彻底改变AI应用。
-
小米发布MiMo-V2.5-Pro-FP4-DFlash以实现高效AI推理
小米发布了MiMo-V2.5-Pro-FP4-DFlash,这是一款为高效推理而优化的新模型。它采用了专家级FP4量化,以减小内存占用和带宽压力,同时保持质量。该模型还集成了BF16 DFlash草稿器,用于推测性解码,通过每次前向传播提出token块来实现更快的token生成。