PulseAugur
实时 08:16:44
实体 inclusionAI

inclusionAI

PulseAugur coverage of inclusionAI — every cluster mentioning inclusionAI across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
9
90 天内 19
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
关系
情绪 · 30 天

7 天有情绪数据

最近 · 第 1/1 页 · 共 19 条
  1. TOOL · CL_210662 ·

    AI API 摘要:Qwen 价格飙升,Z.ai 增加 1M 上下文,AI21 & Mancer 模型下架

    2026 年 8 月 20 日的 AI API 摘要,重点介绍了各提供商的显著价格变动和模型更新。Qwen 的 Qwen3.6 27B 模型在提示词和完成词元的价格上都有大幅上涨,影响了长文本生成的成本。Z.ai 推出了其 GLM Latest 模型,具有 1M 词元上下文窗口,满足了需要广泛上下文的用户需求。AI21 的 Jamba Large 1.7 和 Mancer 的 Weaver (alpha) 模型已被移除,要求用户迁移其…

  2. TOOL · CL_208348 ·

    Ling 3.0 Tiny 模型通过高效的辅助任务增强主要 LLM

    Ling 3.0 Tiny 模型正被用作 Hermes 和 Qwen 3.8-27B 等大型语言模型的辅助组件。用户发现 Ling 3.0 Tiny 可以高效地处理上下文压缩和摘要等任务,从而加快主模型的处理速度。这个较小的模型在处理高提示方面表现出惊人的速度,能够适应有限的 VRAM,并且可以动态集成到代理设置中,而不会显著影响整体质量。

  3. SIGNIFICANT · CL_192496 ·

    inclusionAI 发布轻量级 Ling-3.0-tiny MoE 模型以支持本地部署

    inclusionAI 发布了 Ling-3.0-tiny,这是一款新的混合推理专家混合(MoE)模型,总参数为 79 亿,每个 token 激活参数为 13 亿。该模型专为高效的本地部署和资源受限环境而设计,提供强大的推理和代理能力。它采用了新颖的 Kimi Delta Attention (KDA) 和 Multi-Head Latent Attention (MLA) 架构,支持快速响应和多步推理,并在 Apple Silico…

  4. SIGNIFICANT · CL_190317 ·

    蚂蚁集团 Ling 3.0 Flash 模型发布,支持本地部署

    蚂蚁集团 inclusionAI 推出的 Ling 3.0 Flash,一个拥有 124B 参数的混合专家模型,已获得 MIT 许可并在 Hugging Face 上发布。该模型专为本地运行而设计,由于其每个 token 只激活 5.1B 参数的架构,相比 Kimi K3 等其他大模型,所需的内存显著减少。它支持长上下文的混合线性注意力,并默认支持推理,也可选择禁用推理以获得更快的响应。该模型可以在拥有 96GB 统一内存的 Mac …

  5. COMMENTARY · CL_189062 ·

    用户将例行 AI 任务从前沿模型降级以节省成本

    一位 Reddit 用户分析了他们的 OpenAI API 支出,发现分类、文档摘要和路由等例行任务占了他们账单的大部分。他们发现这些常见任务不需要前沿模型,因此选择改用 InclusionAI 的 Ling 3.0 Tiny 模型来执行这些操作。此举旨在通过为日常 AI 需求使用功能较弱但效率更高的模型来降低成本,将前沿模型保留给需要高级判断的任务。

  6. COMMENTARY · CL_182049 ·

    AI实验室的开源模型发布与其资金结构挂钩

    几家AI实验室正在发布开源模型,但它们的资金结构决定了它们继续这种做法的能力。DeepSeek由一位富有的创始人及其巨额个人投资支持,尽管有外部资金,但仍保持控制权。相比之下,Qwen(阿里云)和inclusionAI(蚂蚁集团)等公司则利用不相关的母公司为其提供资金,并将开放模型作为获取云服务或支付客户的策略。Z.ai(智谱)利用开放权重来建立企业信誉,而Moonshot和MiniMax则分别专注于大型模型和消费者应用,其中Mini…

  7. SIGNIFICANT · CL_182047 ·

    inclusionAI 发布 Ling-3.0-flash 模型,提供官方 FP8 权重

    inclusionAI 已在 Hugging Face 上发布其 Ling-3.0-flash 模型,提供 BF16 和官方 FP8 版本。该模型拥有 1275 亿个总参数和 51 亿个激活参数,采用具有 512 个专家的细粒度架构。FP8 版本体积显著减小,约为 128GB,对于拥有大量统一内存或多 GPU 设置的用户来说更加易于使用。

  8. SIGNIFICANT · CL_162077 ·

    蚂蚁集团 inclusionAI 发布 Ling-3.0-flash,支持256K上下文 · 已追踪2个来源

    inclusionAI,蚂蚁集团的一项计划,发布了 Ling-3.0-flash,一个拥有1240亿参数的混合专家模型。该模型拥有256,000个token的上下文窗口,专为高效的代理任务和长上下文工作流而设计。Ling-3.0-flash 目前可通过 OpenRouter 和 Vercel 的 AI Gateway API 访问,并提供至8月3日的免费访问。

  9. TOOL · CL_121910 ·

    LLM定价波动:NVIDIA、Qwen和Z.ai价格调整;新增模型 · 追踪10个来源

    Token Ledger 发布了 2026 年 8 月初 LLM 定价变化的每日更新。包括 NVIDIA Nemotron 3 Super 和 Ultra、Qwen 变体以及 Z.ai 的 GLM 5.2 在内的几款模型价格进行了调整,报告显示有涨有跌。新增了 Meta 的 Muse Spark 1.2 和 inclusionAI 的 Ling-3.0-flash 等新模型,同时一些知名模型如 Gemini、Claude 和 GPT-…

  10. RESEARCH · CL_106814 ·

    新的AI安全护栏挑战推理必要性,提升多模态安全性

    两篇新的研究论文探讨了AI安全护栏的有效性和适应性。其中一篇论文LeanGuard质疑复杂推理在内容审核中的必要性,证明一个轻量级的、仅标签的编码器可以匹配基于推理的大模型的准确性,同时速度更快、效率更高。另一篇论文介绍了SingGuard,这是一种为视觉语言模型设计的策略自适应多模态安全护栏,能够动态适应不断变化的AI安全策略,并在新的多模态基准测试中取得最先进的性能。

  11. TOOL · CL_96668 ·

    AI模型定价调整:NVIDIA、MoonshotAI、DeepSeek降价;Z.ai推出长上下文模型

    多家AI模型提供商宣布了定价调整和新模型发布。NVIDIA的Nemotron 3 Ultra完成了价格下调,有利于长文本生成工作负载。MoonshotAI的Kimi K2.7 Code和DeepSeek的V4 Flash模型也降低了提示和完成成本,面向对输入令牌费用敏感的开发者以及寻求低延迟推理的用户。此外,Z.ai推出了GLM 5.2,一个具有1,048,576个令牌上下文窗口的模型,但生成成本中等到偏高。

  12. SIGNIFICANT · CL_92035 ·

    LLM 定价变动:Kimi K2.7 涨价,Claude 3.5 Haiku 下架,新增 Gemini 模型 · 追踪 8 个来源

    Token Ledger 报告了多家供应商的几项 LLM 定价调整以及模型增减情况。值得注意的是,MoonshotAI 的 Kimi K2.7 Code 的 completions 价格有所上涨,而其 Kimi Latest 和 K2.6 版本的 prompt 价格略有下降。Z.ai 调整了其 GLM 5.2 模型的定价,提供了优惠,并推出了具有高上下文能力的 GLM 5V Turbo。多款模型已从可用列表中移除,包括 Anthrop…

  13. TOOL · CL_91238 ·

    InclusionAI 免费发布 Ring 2.5 1T 模型

    InclusionAI 已在其 kilocode 平台免费提供其 Ring 2.5 1T 模型。此次发布还附带了一个 YouTube 教程,面向对 AI 编码感兴趣的用户。

  14. TOOL · CL_89014 ·

    inclusionAI 发布 Vista 9B/4B GUI 基础模型

    inclusionAI 发布了 Vista 9B 和 Vista 4B,这是专为 GUI 基础设计的新的视觉语言模型。这些模型使用视图一致的 GRPO 方法和自验证的跨视图锚定进行训练,并基于 Qwen3.5 主干。这些模型将自然语言指令和屏幕截图映射到标准化框架内的点击坐标,从而实现对图形用户界面的精确交互。

  15. TOOL · CL_68792 ·

    AI API 价格大幅下调 inclusionAI 的 Ring-2.6-1T 模型

    inclusionAI 已大幅降低其 Ring-2.6-1T 模型的定价,将提示和完成价格均下调了 75%。这一变化为使用该模型进行大批量推理的团队提供了可观的成本节省。此外,Z.ai 略微降低了其 GLM 5 模型的完成价格,而 OpenRouter 则添加了 Fusion 作为免费的实验模型。

  16. COMMENTARY · CL_59391 ·

    模型目录新增、价格变动和移除

    模型目录新增了模型,包括 StepFun 的 Step 3.7 Flash,该模型以适中的成本提供大上下文生成。Anthropic 发布了两个新的 Claude Opus 4.8 变体:“Fast”版本面向优先考虑速度的企业,“Standard”版本面向高质量输出。DeepSeek 的 V3.2 Speciale 已从目录中移除,影响了依赖其低成本处理大批量工作负载的用户。

  17. TOOL · CL_40541 ·

    LLM 模型目录出现价格变动、移除和新的免费套餐

    LLM 模型目录在不同提供商的价格和可用性方面发生了重大变化。MoonshotAI 的 Kimi 模型价格有所下调,而 MoonshotAI 的 Kimi K2.6 和 NVIDIA 的 Nemotron 3.5 等一些免费模型已被移除或更新。OpenAI 的 GPT-4 模型和百度的 ERNIE 模型的一些旧版本也已从可用列表中淘汰。此外,NousResearch Hermes 3 70B Instruct 等一些模型价格大幅上涨,…

  18. RESEARCH · CL_32631 ·

    InclusionAI 发布万亿参数模型 Ring 2.6-1T

    InclusionAI 推出了万亿参数推理模型 Ring 2.6-1T,旨在用于企业自动化和复杂的代理工作流。该模型采用了异步强化学习训练方法和灵活的推理努力机制。同时,Hugging Face 的 smolagents 库引入了异步工具支持,推动了面向代理系统的 AI 发展。

  19. RESEARCH · CL_29077 ·

    开源 AntAngelMed 模型以 103B 参数提供高效医疗 AI

    研究人员推出 AntAngelMed,一个拥有 1030 亿参数的开源医疗语言模型。它采用了专家混合(MoE)架构,每次查询仅激活 61 亿参数,从而提高了效率。这种设计使其在 H20 硬件上能够以超过每秒 200 个 token 的速度,媲美 400 亿参数密集模型的性能。该模型支持 128K 上下文长度,并经历了包括在医学语料库上预训练、监督微调和强化学习在内的三阶段训练过程。