PulseAugur
中
实时 15:58:08
实体 MiniMax M2.5

MiniMax M2.5

PulseAugur coverage of MiniMax M2.5 — every cluster mentioning MiniMax M2.5 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
27
90 天内 27
发布 · 30天
0
90 天内 0
论文 · 30天
8
90 天内 8
层级分布 · 90 天
主题
关系
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/2 页 · 共 33 条
  1. TOOL · CL_283538 ·

    开发者使大型 MiniMax-M2 模型能在 32GB RAM 笔记本电脑上运行

    一位开发者创建了一个名为 Picchio 的 C 语言推理引擎,允许大型专家混合(MoE)模型在内存小于模型大小的系统上运行,方法是从磁盘流式传输专家。该项目最近增加了对 MiniMax-M2 模型(转换为 INT4 后约 122 GB)的支持。该设置在配备 32 GB RAM 和 NVMe SSD 的 12 核笔记本电脑上实现了约 0.48 tokens/秒的性能,证明了缓存大小是性能的关键因素。

  2. COMMENTARY · CL_278868 ·

    量化对大型语言模型的影响:解释质量与压缩

    dev.to 上最近的一篇讨论探讨了量化对大型语言模型的影响,特别是在 OpenCode Go 订阅服务的背景下。量化压缩模型权重以降低内存和计算需求,但其有效性因使用的方法和比特深度而异。虽然 Q8_0 和 Q5_K_M 等较高比特深度几乎保留了原始模型的所有质量,但 Q4_K_M,尤其是 Q2_K 等较低比特深度可能导致性能明显下降,这可能解释了用户对使用经过大量量化模型的服务的抱怨。

  3. TOOL · CL_252447 ·

    DFlash 扩散模型在测试中未能加速 Gemma LLM

    一种名为 DFlash 的新技术旨在通过使用通常用于图像生成的扩散模型来同时预测多个令牌,从而加速 LLM 生成。与其他专注于特定模型的方法不同,DFlash 被设计成一种通用的附加组件,可与包括 Google、MiniMax 和 Qwen 在内的各种 LLM 兼容。然而,对 Gemma-4-12B 的实际测试表明,DFlash 在速度上并未优于 Gemma 的原生 Assistant 模型。

  4. RESEARCH · CL_240476 ·

    新方法通过推测性解码提升大语言模型推理速度

    研究人员正在开发用于加速大语言模型(LLM)推理的先进推测性解码技术。一种名为 X-CoSD 的方法,通过处理词汇差异和最小化数据传输,专注于设备上小型模型与大型服务器模型之间的有效通信。另一种名为 Osprey 的方法,利用预训练的小型语言模型作为草稿生成器,通过轻量级过程将其适配到各种目标模型,以提高接受率和令牌生成速度。此外,正在探索一种名为在线草稿协同训练(Online Draft Co-Training)的技术,通过优化注意…

  5. TOOL · CL_228653 ·

    新AI工作流以85%的准确率提取肿瘤学数据

    研究人员开发了Nimblemind多智能体系统(nMAS),这是一个旨在从碎片化的患者文档中提取临床相关肿瘤学信息的工作流。该系统旨在将非结构化文本转换为结构化数据,保留临床上下文并实现跨各种医疗细节的准确归因。在对230份去标识化的肿瘤学文档进行的追溯性评估中,nMAS达到了85.0%的F1分数,显著优于达到66.4%的MiniMax M2.5比较器。研究结果表明,nMAS是将复杂的医疗记录转化为可用结构化数据的可行解决方案。

  6. TOOL · CL_223645 ·

    中国 AI 模型 GLM 和 MiniMax 可在全球访问,但有限制 · 跟踪 1 个来源

    截至 2026 年 8 月,中国的 AI 模型 GLM(来自智谱 AI)和 MiniMax 在中国境外可访问,但直接访问存在挑战。智谱 AI 的国际 API 定价约为其国内费率的两倍,而 MiniMax 的定价结构已于 2026 年 2 月发生变化,这使得成本预测复杂化。此外,北京潜在的政策审查可能会影响对这些前沿模型的访问。对于国际开发者而言,一个统一的网关,提供 GLM-5.x 和 MiniMax M2.5–M3 以及其他主要模型…

  7. TOOL · CL_210662 ·

    AI API 摘要:Qwen 价格飙升,Z.ai 增加 1M 上下文,AI21 & Mancer 模型下架

    2026 年 8 月 20 日的 AI API 摘要,重点介绍了各提供商的显著价格变动和模型更新。Qwen 的 Qwen3.6 27B 模型在提示词和完成词元的价格上都有大幅上涨,影响了长文本生成的成本。Z.ai 推出了其 GLM Latest 模型,具有 1M 词元上下文窗口,满足了需要广泛上下文的用户需求。AI21 的 Jamba Large 1.7 和 Mancer 的 Weaver (alpha) 模型已被移除,要求用户迁移其…

  8. RESEARCH · CL_198175 ·

    研究人员开发 Self-Harness,使 LLM 代理能够自主改进其自身系统

    一篇新研究论文介绍了一种名为“Self-Harness”的方法,该方法允许基于 LLM 的代理自主改进其自身的运行 Harness。这个迭代过程包括识别模型特定的失败模式、生成 Harness 修改以及通过回归测试验证这些更改。当应用于各种模型和基准测试时,Self-Harness 持续提高了性能,为实现自改进的 AI 代理指明了方向。

  9. TOOL · CL_180282 ·

    CI检查管理中文大语言模型名称和Token预算

    一位开发者创建了一个CI检查,用于管理快速变化的中文大语言模型名称及其相关的Token预算。该工具通过将模型目录视为可固定和检查的部署时依赖项,帮助确保生产稳定性。演示 walkthrough 展示了如何使用AIWave定价页面构建一个清单检查,该页面作为各种中文AI模型的入口,根据提供的比例计算美元价格。

  10. TOOL · CL_140070 ·

    中国AI模型价格比西方低50倍,性能不输 · 追踪4个来源

    2026年AI API定价的比较显示,智谱AI、百度、DeepSeek和阿里巴巴集团等中国供应商提供的成本远低于OpenAI、Anthropic和Google等西方竞争对手。GLM 4.7 Flash等模型免费,而其他模型的价格比西方选项便宜几个数量级,且性能通常相当或更优。文章建议采用从更便宜的模型开始进行原型设计,并将模型复杂性与任务需求相匹配的策略来优化成本。

  11. COMMENTARY · CL_131880 ·

    AI 自进化可能始于外部系统,而非模型权重

    前 OpenAI 安全副总裁 Wonyong Li 提出了一条 AI 自进化的新路径,建议从外部操作系统(Harness)开始,而不是直接修改模型权重。该 Harness 系统负责管理工具使用、上下文、任务拆分和结果验证,并可根据观察到的失败进行迭代改进。DeepSeek 的崔天言等研究人员认为,改进 Harness 是 AI 进步的一个有前景的方向,有可能在不改变核心模型的情况下实现显著的性能提升。

  12. RESEARCH · CL_131276 ·

    AI系统改进活检报告中的幽门螺杆菌检测

    研究人员开发了Nimblemind多智能体系统(nMAS),以改进从胃活检报告中提取幽门螺杆菌阳性证据。在一项使用新加坡54份去标识化报告的试点研究中,nMAS在分类与幽门螺杆菌感染相关的四个关键字段时达到了98.61%的准确率。虽然MiniMax M2.5比较器显示出相似的预测性能,但nMAS通过提供带有支持性源句的统一报告级输出来提供更优越的工作流程集成和可追溯性。该系统可以显著减少手动审查时间,可能节省大量员工时间和成本。

  13. TOOL · CL_127840 ·

    MiniMax 模型现已登陆 Amazon Bedrock,支持代理工作负载

    Amazon Bedrock 现已提供来自全球人工智能技术公司 MiniMax 的三款开放权重基础模型。这些模型属于 MiniMax M2 系列,专为软件工程和代理用例而设计,其中最新的 M2.5 模型专门针对原生代理执行进行了训练。此次集成使组织能够在 AWS 的安全托管基础设施内利用这些先进模型,确保数据保护和运营控制,而无需自行托管。

  14. TOOL · CL_121910 ·

    LLM定价波动:NVIDIA、Qwen和Z.ai价格调整;新增模型 · 追踪10个来源

    Token Ledger 发布了 2026 年 8 月初 LLM 定价变化的每日更新。包括 NVIDIA Nemotron 3 Super 和 Ultra、Qwen 变体以及 Z.ai 的 GLM 5.2 在内的几款模型价格进行了调整,报告显示有涨有跌。新增了 Meta 的 Muse Spark 1.2 和 inclusionAI 的 Ling-3.0-flash 等新模型,同时一些知名模型如 Gemini、Claude 和 GPT-…

  15. RESEARCH · CL_113320 ·

    新算法TASKER改进视频理解和代理任务

    研究人员开发了TASKER,一种新颖的关键帧提取算法,旨在提高视频问答(VideoQA)和视频引导代理任务的性能。该算法在一个新论文中进行了详细介绍,它联合考虑任务相关性和场景动态性来识别信息帧。还引入了一个新的基准VG-GUIBench,用于评估多模态大语言模型(MLLMs)遵循视频教程和完成GUI交互任务的能力,证明了TASKER的有效性。

  16. TOOL · CL_100448 ·

    Model Gateway使MiniMax模型可在Claude Code和opencode中使用

    一个名为Model Gateway的第三方服务已被开发出来,允许开发者将MiniMax模型(如MiniMax-M3)集成到通常支持OpenAI或Anthropic API的现有编码工作流程中。该网关提供了兼容层,使得在Claude Code和opencode等工具中使用MiniMax模型无需编写自定义适配器代码。开发者可以通过配置指向Model Gateway端点的特定环境变量或配置设置,来测试MiniMax模型执行代码解释、重构和测…

  17. RESEARCH · CL_99607 ·

    新研究探索用于智能体生存、导航和可解释性的高级强化学习 · 跟踪 7 个来源

    研究人员正在探索强化学习(RL)的高级技术,以增强智能体的性能和可解释性。一项研究提出了程序化策略(PERL)作为进化 RL 中神经策略(NERL)的替代方案,证明了 PERL 更高的生存率。另一篇论文侧重于使用 RL 进行自主机器人的流感知导航,发现使用速度和记忆传感器训练的智能体优于那些具有显式全局流参数的智能体。此外,正在开发新的方法来解释 RL 智能体,例如使用归纳逻辑编程(ILP)为策略可解释性创建客观指标,以及一种称为 S…

  18. RESEARCH · CL_88575 ·

    oMLX 通过 KV 缓存提升 Apple Silicon LLM 性能

    oMLX 是一个面向 Apple Silicon 的开源 LLM 推理服务器,在处理大型模型和复杂工作流方面展现出显著的性能提升。社区基准测试和本地测试突显了 oMLX 相较于 Ollama 和 LM Studio 等替代方案的优势,尤其是在涉及编码代理和持久化 KV 缓存的场景中。该服务器利用 SSD 进行 KV 缓存的能力极大地缩短了首次令牌生成时间 (TTFT),使得 Claude Code 和 Qwen3-Coder-Next…

  19. TOOL · CL_79558 ·

    Self-Harness 使 LLM 代理能够改进其自身的操作工具集

    研究人员开发了一种名为 Self-Harness 的新颖方法,使基于 LLM 的代理能够自主改进其自身的操作工具集。这个迭代过程包括识别模型特定的失败模式、生成有针对性的工具集修改以及通过回归测试验证这些更改。当应用于 Terminal-Bench-2.0 基准测试中的三个不同基础模型时,Self-Harness 显著提升了性能,展示了通往自优化 AI 代理的道路。

  20. SIGNIFICANT · CL_71038 ·

    MiniMax 发布 M3,拥有百万级上下文,在 SWE-Bench 上超越 GPT-5.5

    中国人工智能初创公司 MiniMax 发布了其 M3 模型,拥有百万级 token 上下文窗口和原生多模态能力,在 SWE-Bench Pro 基准测试中表现优于 GPT-5.5。该公司还以远低于 Anthropic 的 Claude Opus 4.7 等竞争对手的价格提供其 M2.5 模型,同时保持与 OpenAI 和 Anthropic 协议的 API 兼容性。MiniMax 提供开源模型用于自托管,并通过其 Cline 代理与 …