Mellum2
PulseAugur coverage of Mellum2 — every cluster mentioning Mellum2 across labs, papers, and developer communities, ranked by signal.
- 2026-06-09 product_launch JetBrains has released Mellum2, a new 12 billion parameter Mixture-of-Experts model. 来源
- 2026-06-02 product_launch JetBrains released Mellum2, a 12B-parameter open-source coding model designed for on-premises AI infrastructure. 来源
- 2026-06-02 product_launch JetBrains released Mellum2, an open-source 12B parameter Mixture-of-Experts model for specialized AI tasks. 来源
- 2026-06-01 product_launch JetBrains has launched Mellum2, a 12 billion parameter expert mixture model. 来源
2 天有情绪数据
-
JetBrains 发布 Mellum2 模型;Hugging Face 发布评估和基准测试 · 跟踪 3 个来源
JetBrains 推出了 Mellum2,一个 1200 亿参数的混合专家模型,详情发布在 Hugging Face 上。另外,Hugging Face 在其模型页面上发布了一系列过去的模型评估结果。此外,IBM Research 推出了 ScarfBench,一个专注于迁移企业 Java 框架的 AI 代理基准测试。
-
Hugging Face 重点介绍 PaddleOCR 3.5、JetBrains 的 Mellum2 和 IBM 的 ScarfBench
Hugging Face 正在重点介绍几项新的 AI 进展。PaddleOCR 发布了 3.5 版本,集成了 Transformers 后端以增强 OCR 和文档分析功能。JetBrains 推出了 Mellum2,这是一个专为专业人士设计的大型专家混合模型。此外,IBM Research 开发了 ScarfBench,这是一个用于 AI 代理迁移企业 Java 框架的基准测试。
-
JetBrains 发布 Mellum2 专家模型;PaddleOCR 3.5 增加 Transformer 后端
JetBrains 推出了 Mellum2,一个 1200 亿参数的混合专家模型。另外,PaddleOCR 发布了 3.5 版本,该版本利用 Transformer 后端进行 OCR 和文档分析任务。这两个公告都通过 Mastodon 上的自动帖子分享,链接到 Hugging Face 的博客文章,详细介绍了各自的进展。
-
JetBrains发布Mellum2,一款12B MoE代码生成模型
JetBrains发布了Mellum2,这是一款拥有120亿参数的专家混合(Mixture-of-Experts)模型,专为高效代码生成和IDE集成而设计。早期用户测试表明其性能令人印象深刻,即使在约13万token的上下文长度下,模型也能实现高token生成速度。Mellum2在工具调用和复杂任务执行方面展现出强大的能力,在特定基准测试中优于同等或更大规模的其他模型。
-
NVIDIA、ServiceNow、JetBrains、Dharma-AI发布新AI模型和工具
NVIDIA发布了Nemotron 3.5 Content Safety,一个支持可定制策略和全球合规的企业级多模态安全模型。ServiceNow-AI推出了EVA-Bench Data 2.0,一个扩展的AI代理评估基准,涵盖工具使用、推理和错误恢复。JetBrains推出了Mellum2,一个为软件开发任务优化的12B参数MoE模型,而Dharma-AI发布了将Direct Preference Optimization从聊天机器…
-
JetBrains 发布 Mellum2,一个用于 AI 基础设施的开源 MoE 模型
JetBrains 发布了 Mellum2,一个开源的 120 亿参数混合专家(MoE)模型,专为 AI 流水线中的专业化任务而设计。与前沿模型不同,Mellum2 被定位为一种“焦点模型”,针对软件工程工作流中的速度和效率进行了优化,包括代码生成、调试和工具使用。其架构支持快速推理,使其适用于气隙或合规敏感环境中的本地部署,为 Claude Code 等依赖 API 的模型提供了替代方案。
-
JetBrains 发布 Mellum2,一款 1200 亿参数的专家混合模型
JetBrains 发布了 Mellum2,这是一款 1200 亿参数的专家混合模型。该模型专为专家任务设计,旨在提供专业能力。此次发布通过 Hugging Face 宣布,详细介绍了其架构和潜在应用。
-
JetBrains 发布 Mellum2,Heretic 工具助力审查移除,NVIDIA 推出 Cosmos 3
JetBrains 发布了 Mellum2,一个拥有 120 亿参数的专家混合(MoE)模型,针对高效的本地 AI 推理进行了优化。与此同时,GitHub 上出现了一个名为 'Heretic' 的新工具,旨在自动移除开源语言模型的审查,使用户能够更好地控制模型的输出。NVIDIA 也推出了 Cosmos 3,一个专注于物理 AI 推理和行动的开源全能模型,旨在增强消费级硬件的多模态能力。
-
JetBrains 发布 Mellum2 作为开源 LLM,用于快速 AI 工作流
JetBrains 发布了 Mellum2,一个新发布的开源大语言模型。该模型专为高效的 AI 工作流而设计,旨在提供快速的性能。其开源性质允许 AI 社区进行更广泛的采用和定制。
-
JetBrains 发布高效 Mellum2 MoE 模型;研究推动 MoE 技术进步
JetBrains 发布了 Mellum2,一个开源的 120 亿参数专家混合(MoE)模型,针对文本和代码任务的高效推理进行了优化。该模型每个 token 只激活其参数的一小部分,从而实现更快、更低延迟的操作,适用于大型 AI 系统中的路由、RAG 管道和子代理任务。多篇研究论文还探讨了 MoE 架构的进展,包括 CRAFT 等高效服务技术、DAG-MoE 等新颖聚合方法、Kappa-SwiGLU 的自适应门控以及 ProbMoE …