PulseAugur
中
实时 14:14:57
实体 inclusionAI

inclusionAI

PulseAugur coverage of inclusionAI — every cluster mentioning inclusionAI across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
21
90 天内 21
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
关系
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/2 页 · 共 23 条
  1. TOOL · CL_249429 ·

    Edge0-AI 将 35B MoE 模型从 SSD 流式传输以适应 3GB RAM

    Edge0-AI 发布了 Edge0,这是一个开源流式推理引擎,旨在消费级硬件上运行大型混合专家(MoE)模型。该引擎通过在 SSD 上内存映射整个模型检查点,并为每个 token 只将活动使用的专家加载到 RAM 中来实现这一点。这种方法允许一个拥有 350 亿参数的模型在峰值内存使用量约为 3GB 的情况下运行,尽管它严重依赖操作系统文件缓存,并且频繁的读取可能会影响 SSD 的寿命。

  2. FRONTIER RELEASE · CL_247436 ·

    InclusionAI 发布 Ling 3.0 Flash VL,开放权重,上下文长度大 · 跟踪 4 个来源

    InclusionAI 发布了 Ling 3.0 Flash VL,这是一款开放权重的视觉语言模型。该模型支持高达 262.1k token 的上下文窗口,并以每百万 token 0.06 美元/0.18 美元的价格提供,具有竞争力。此次发布旨在为闭源模型提供强大、经济高效且易于访问的替代方案。

  3. COMMENTARY · CL_241727 ·

    小型语言模型对比:Spark-X2.5-4B、Ling 3.0 Tiny、Nanbeige4.2-3B

    在 r/LocalLLaMA 子论坛上的一场讨论,对比了三个小型语言模型:XHToken 的 Spark-X2.5-4B、inclusionAI 的 Ling 3.0 Tiny 和 Nanbeige 的 Nanbeige4.2-3B。用户们正试图找出这些同等规模的模型中,哪一个目前最实用,并指出它们往往会避免在基准测试结果中进行直接比较。

  4. SIGNIFICANT · CL_241117 ·

    蚂蚁集团发布金融领域大模型,支持256K上下文,并提及多模态变体

    蚂蚁集团发布了Ling-3.0-flash-Fin,这是一款专为金融任务增强的新型大语言模型。该模型拥有1240亿参数,其中51亿参数被激活,上下文窗口为256K,在端到端金融研究、基于来源的搜索和多文档推理方面表现出色。它还能处理估值和电子表格工作流,生成可用于研究的输出。此外,一个相关的模型Ling-3.0-flash-VL,因其多模态能力而受到关注,该模型集成了图像和视频理解能力,拥有1M token的上下文窗口和稀疏MoE架构。

  5. TOOL · CL_210662 ·

    AI API 摘要:Qwen 价格飙升,Z.ai 增加 1M 上下文,AI21 & Mancer 模型下架

    2026 年 8 月 20 日的 AI API 摘要,重点介绍了各提供商的显著价格变动和模型更新。Qwen 的 Qwen3.6 27B 模型在提示词和完成词元的价格上都有大幅上涨,影响了长文本生成的成本。Z.ai 推出了其 GLM Latest 模型,具有 1M 词元上下文窗口,满足了需要广泛上下文的用户需求。AI21 的 Jamba Large 1.7 和 Mancer 的 Weaver (alpha) 模型已被移除,要求用户迁移其…

  6. TOOL · CL_208348 ·

    Ling 3.0 Tiny 模型通过高效的辅助任务增强主要 LLM

    Ling 3.0 Tiny 模型正被用作 Hermes 和 Qwen 3.8-27B 等大型语言模型的辅助组件。用户发现 Ling 3.0 Tiny 可以高效地处理上下文压缩和摘要等任务,从而加快主模型的处理速度。这个较小的模型在处理高提示方面表现出惊人的速度,能够适应有限的 VRAM,并且可以动态集成到代理设置中,而不会显著影响整体质量。

  7. SIGNIFICANT · CL_192496 ·

    inclusionAI 发布轻量级 Ling-3.0-tiny MoE 模型以支持本地部署

    inclusionAI 发布了 Ling-3.0-tiny,这是一款新的混合推理专家混合(MoE)模型,总参数为 79 亿,每个 token 激活参数为 13 亿。该模型专为高效的本地部署和资源受限环境而设计,提供强大的推理和代理能力。它采用了新颖的 Kimi Delta Attention (KDA) 和 Multi-Head Latent Attention (MLA) 架构,支持快速响应和多步推理,并在 Apple Silico…

  8. SIGNIFICANT · CL_190317 ·

    蚂蚁集团 Ling 3.0 Flash 模型发布,支持本地部署

    蚂蚁集团 inclusionAI 推出的 Ling 3.0 Flash,一个拥有 124B 参数的混合专家模型,已获得 MIT 许可并在 Hugging Face 上发布。该模型专为本地运行而设计,由于其每个 token 只激活 5.1B 参数的架构,相比 Kimi K3 等其他大模型,所需的内存显著减少。它支持长上下文的混合线性注意力,并默认支持推理,也可选择禁用推理以获得更快的响应。该模型可以在拥有 96GB 统一内存的 Mac …

  9. COMMENTARY · CL_189062 ·

    用户将例行 AI 任务从前沿模型降级以节省成本

    一位 Reddit 用户分析了他们的 OpenAI API 支出,发现分类、文档摘要和路由等例行任务占了他们账单的大部分。他们发现这些常见任务不需要前沿模型,因此选择改用 InclusionAI 的 Ling 3.0 Tiny 模型来执行这些操作。此举旨在通过为日常 AI 需求使用功能较弱但效率更高的模型来降低成本,将前沿模型保留给需要高级判断的任务。

  10. COMMENTARY · CL_182049 ·

    AI实验室的开源模型发布与其资金结构挂钩

    几家AI实验室正在发布开源模型,但它们的资金结构决定了它们继续这种做法的能力。DeepSeek由一位富有的创始人及其巨额个人投资支持,尽管有外部资金,但仍保持控制权。相比之下,Qwen(阿里云)和inclusionAI(蚂蚁集团)等公司则利用不相关的母公司为其提供资金,并将开放模型作为获取云服务或支付客户的策略。Z.ai(智谱)利用开放权重来建立企业信誉,而Moonshot和MiniMax则分别专注于大型模型和消费者应用,其中Mini…

  11. SIGNIFICANT · CL_182047 ·

    inclusionAI 发布 Ling-3.0-flash 模型,提供官方 FP8 权重

    inclusionAI 已在 Hugging Face 上发布其 Ling-3.0-flash 模型,提供 BF16 和官方 FP8 版本。该模型拥有 1275 亿个总参数和 51 亿个激活参数,采用具有 512 个专家的细粒度架构。FP8 版本体积显著减小,约为 128GB,对于拥有大量统一内存或多 GPU 设置的用户来说更加易于使用。

  12. SIGNIFICANT · CL_162077 ·

    蚂蚁集团 inclusionAI 发布 Ling-3.0-flash,支持256K上下文 · 已追踪2个来源

    inclusionAI,蚂蚁集团的一项计划,发布了 Ling-3.0-flash,一个拥有1240亿参数的混合专家模型。该模型拥有256,000个token的上下文窗口,专为高效的代理任务和长上下文工作流而设计。Ling-3.0-flash 目前可通过 OpenRouter 和 Vercel 的 AI Gateway API 访问,并提供至8月3日的免费访问。

  13. TOOL · CL_121910 ·

    LLM定价波动:NVIDIA、Qwen和Z.ai价格调整;新增模型 · 追踪10个来源

    Token Ledger 发布了 2026 年 8 月初 LLM 定价变化的每日更新。包括 NVIDIA Nemotron 3 Super 和 Ultra、Qwen 变体以及 Z.ai 的 GLM 5.2 在内的几款模型价格进行了调整,报告显示有涨有跌。新增了 Meta 的 Muse Spark 1.2 和 inclusionAI 的 Ling-3.0-flash 等新模型,同时一些知名模型如 Gemini、Claude 和 GPT-…

  14. RESEARCH · CL_106814 ·

    新的AI安全护栏挑战推理必要性,提升多模态安全性

    两篇新的研究论文探讨了AI安全护栏的有效性和适应性。其中一篇论文LeanGuard质疑复杂推理在内容审核中的必要性,证明一个轻量级的、仅标签的编码器可以匹配基于推理的大模型的准确性,同时速度更快、效率更高。另一篇论文介绍了SingGuard,这是一种为视觉语言模型设计的策略自适应多模态安全护栏,能够动态适应不断变化的AI安全策略,并在新的多模态基准测试中取得最先进的性能。

  15. TOOL · CL_96668 ·

    AI模型定价调整:NVIDIA、MoonshotAI、DeepSeek降价;Z.ai推出长上下文模型

    多家AI模型提供商宣布了定价调整和新模型发布。NVIDIA的Nemotron 3 Ultra完成了价格下调,有利于长文本生成工作负载。MoonshotAI的Kimi K2.7 Code和DeepSeek的V4 Flash模型也降低了提示和完成成本,面向对输入令牌费用敏感的开发者以及寻求低延迟推理的用户。此外,Z.ai推出了GLM 5.2,一个具有1,048,576个令牌上下文窗口的模型,但生成成本中等到偏高。

  16. SIGNIFICANT · CL_92035 ·

    LLM 定价变动:Kimi K2.7 涨价,Claude 3.5 Haiku 下架,新增 Gemini 模型 · 追踪 8 个来源

    Token Ledger 报告了多家供应商的几项 LLM 定价调整以及模型增减情况。值得注意的是,MoonshotAI 的 Kimi K2.7 Code 的 completions 价格有所上涨,而其 Kimi Latest 和 K2.6 版本的 prompt 价格略有下降。Z.ai 调整了其 GLM 5.2 模型的定价,提供了优惠,并推出了具有高上下文能力的 GLM 5V Turbo。多款模型已从可用列表中移除,包括 Anthrop…

  17. TOOL · CL_91238 ·

    InclusionAI 免费发布 Ring 2.5 1T 模型

    InclusionAI 已在其 kilocode 平台免费提供其 Ring 2.5 1T 模型。此次发布还附带了一个 YouTube 教程,面向对 AI 编码感兴趣的用户。

  18. TOOL · CL_89014 ·

    inclusionAI 发布 Vista 9B/4B GUI 基础模型

    inclusionAI 发布了 Vista 9B 和 Vista 4B,这是专为 GUI 基础设计的新的视觉语言模型。这些模型使用视图一致的 GRPO 方法和自验证的跨视图锚定进行训练,并基于 Qwen3.5 主干。这些模型将自然语言指令和屏幕截图映射到标准化框架内的点击坐标,从而实现对图形用户界面的精确交互。

  19. TOOL · CL_68792 ·

    AI API 价格大幅下调 inclusionAI 的 Ring-2.6-1T 模型

    inclusionAI 已大幅降低其 Ring-2.6-1T 模型的定价,将提示和完成价格均下调了 75%。这一变化为使用该模型进行大批量推理的团队提供了可观的成本节省。此外,Z.ai 略微降低了其 GLM 5 模型的完成价格,而 OpenRouter 则添加了 Fusion 作为免费的实验模型。

  20. COMMENTARY · CL_59391 ·

    模型目录新增、价格变动和移除

    模型目录新增了模型,包括 StepFun 的 Step 3.7 Flash,该模型以适中的成本提供大上下文生成。Anthropic 发布了两个新的 Claude Opus 4.8 变体:“Fast”版本面向优先考虑速度的企业,“Standard”版本面向高质量输出。DeepSeek 的 V3.2 Speciale 已从目录中移除,影响了依赖其低成本处理大批量工作负载的用户。