DeepSeek V3 0324
PulseAugur coverage of DeepSeek V3 0324 — every cluster mentioning DeepSeek V3 0324 across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
AI API 摘要:Qwen 价格飙升,Z.ai 增加 1M 上下文,AI21 & Mancer 模型下架
2026 年 8 月 20 日的 AI API 摘要,重点介绍了各提供商的显著价格变动和模型更新。Qwen 的 Qwen3.6 27B 模型在提示词和完成词元的价格上都有大幅上涨,影响了长文本生成的成本。Z.ai 推出了其 GLM Latest 模型,具有 1M 词元上下文窗口,满足了需要广泛上下文的用户需求。AI21 的 Jamba Large 1.7 和 Mancer 的 Weaver (alpha) 模型已被移除,要求用户迁移其…
-
开放AI模型缩小能力差距,但在企业采用和服务堆栈性能方面落后
开放权重AI模型已显著缩小与专有模型的性能差距,到2026年4月在智能指数上缩小至6分以内。尽管如此,企业对开放模型的采用却滞后,使用率在一年内从19%降至11%。一个关键因素是服务堆栈,相同的开放权重模型在工具调用评估中的性能差异可达15个百分点,具体取决于提供商。虽然开放模型正变得更具成本效益,但在减少幻觉和复杂推理或编码任务的性能方面仍落后于专有选项。
-
开放权重的大语言模型(LLM)可免费访问但运行成本高昂,给开发者带来挑战
文章认为,虽然开放权重的LLM在技术上可以免费访问,但其巨大的规模常常使其在标准硬件上运行成本过高且难以实现。Qwen、DeepSeek、GLM、Kimi和MiniMax等模型被列为这一趋势的例子,参数数量达到数百亿甚至数万亿。作者认为,焦点应从原始参数数量和开放权重转移到实际部署成本和效率上,将效率定义为能力与运营成本的最佳比率。对开发者而言,这意味着在本地推理时优先选择更小、更易于管理模型,并在为产品选择模型时,将活跃参数和实际延…
-
DeepSeek发布开源编码模型,性能媲美GPT-4o
DeepSeek发布了V3-0324,一个开源编码模型,在编码性能上可媲美甚至超越GPT-4o和Claude 3.5 Sonnet等领先模型。该模型采用混合专家(Mixture-of-Experts)架构,拥有6710亿总参数和370亿激活参数,可显著节省推理成本。该模型支持128K token上下文窗口,并通过兼容OpenAI的API提供,便于开发者集成。