Xiaomi 发布了 MiMo-V2.5,这是一款开放权重的全模态AI模型,旨在在单一上下文中原生处理音频、图像和视频。虽然模型的文本推理、编码和JSON提取能力已得到验证,但其全模态功能尚未进行基准测试。一个关键特性是其105万token的上下文窗口,使其适用于需要处理大量数据同时通过自托管维护隐私的会议智能和通话分析等应用。 AI
影响 通过大上下文窗口实现音频、图像和视频数据的自托管、隐私保护分析。
排序理由 来自一家主要科技公司的开放权重全模态模型发布。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →