PulseAugur
实时 10:39:37
实体 MiMo-V2-Pro

MiMo-V2-Pro

PulseAugur coverage of MiMo-V2-Pro — every cluster mentioning MiMo-V2-Pro across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_86809 ·

    新的DSAEval基准测试AI数据科学代理

    一项名为DSAEval的新基准测试已被引入,用于在真实世界问题上评估数据科学代理。该基准测试包括多模态感知、多查询交互以及跨越推理、代码和结果的多维度评估。在评估中,Claude Sonnet 4.5总体表现最佳,而MiMo-V2-Pro和GPT-5.2分别在持续时间和步长效率方面表现出色。研究还发现,多模态感知显著提高了视觉任务的性能,尽管在非结构化数据领域仍存在挑战。

  2. TOOL · CL_82839 ·

    开发者通过智能模型选择和缓存来降低LLM API成本

    开发者可以通过实施几项实用策略,显著降低使用大型语言模型(LLM)API的相关成本。这些策略包括为给定任务选择最具成本效益的模型、利用提示缓存来减少重复的上下文成本,以及采用请求路由将简单的查询导向更便宜的模型,同时为复杂任务保留高级模型。此外,控制输出长度和批量处理请求可以进一步优化支出。

  3. RESEARCH · CL_26037 ·

    小米为MiMo V2 Pro推出基于额度的Token计划

    小米为其MiMo V2 Pro模型推出了一项新的“Token计划”,该计划提供了一种新颖的基于额度的AI服务计费系统。该计划允许用户购买额度,额度将转换为Token,不同的模型和上下文窗口大小具有不同的转换率。该系统旨在通过允许集中使用Token来提供比传统订阅模式更灵活的服务,但它增加了用户预测成本的复杂性,尤其是在进行编码任务时。

  4. RESEARCH · CL_06722 ·

    GPT-5.4 和 Claude Opus 4.7 等前沿大型语言模型出现显著的口头语癖

    一篇新论文分析了八个领先的大型语言模型中口头语癖的普遍性,例如重复短语和谄媚式开场白。研究人员开发了一个口头语癖指数(VTI)来量化这些语癖,发现在 Gemini 3.1 Pro 和 DeepSeek V3.2 等模型之间存在显著差异。研究还发现,在多轮对话和主观任务中,这些语癖会增加,并且与感知到的自然度呈负相关,这表明当前的训练方法存在“对齐税”。

  5. FRONTIER RELEASE · CL_01752 ·

    MiniMax 2.7: GLM-5 以三分之一成本达到 SOTA 开源模型

    MiniMax 发布了 MiniMax 2.7,这是一个开源模型,在多项基准测试中性能与 Z.ai 的 GLM-5 相当,但成本却显著降低。该模型以其效率著称,并声称是第一个深度参与自身演进的模型,处理了其工作流程的一部分。MiniMax 还在探索多智能体协作和金融用例,并发布了一个名为 OpenRoom 的开源娱乐应用演示。