Qwen3-Coder 480B
PulseAugur coverage of Qwen3-Coder 480B — every cluster mentioning Qwen3-Coder 480B across labs, papers, and developer communities, ranked by signal.
- 2026-07-19 product_launch Qwen3 Coder 480B and A-35B Vengeance models have seen their prices drop by 44% to $1 per 1M output tokens. 来源
3 天有情绪数据
-
新POLCA系统将LLM服务效率提升20% · 跟踪2个来源
研究人员开发了一种新的分布式LLM服务电源控制系统,可优化GPU能效。该系统名为POLCA,将预填充和解码阶段的电源管理解耦,这与应用单一设置的NVIDIA Max-Q配置文件不同。POLCA的基于模型的校准方法在每焦耳的令牌数和降低延迟方面取得了显著改进,在Qwen3-Coder-480B和Qwen3-235B-A22B等特定模型上超越了供应商配置文件。
-
LU Labs 提供无审查文本AI模型,澄清图像/视频限制
LU Labs 提供一款免费的开源桌面应用程序,支持Windows和Linux,允许用户在自己的机器上本地运行大型语言模型。该公司强调,其托管的文本模型没有额外的审核层,这意味着它们会按照训练结果进行响应,没有额外的过滤。然而,他们澄清说,托管的图像和视频生成服务确实有内容限制和用户协议,对成人图像或涉及未成年人的内容一概不予例外。
-
LU Labs 提供托管式 AI 模型,作为 Mac LM Studio 的替代品
LU Labs 推出了托管式云服务,作为 Mac 用户 LM Studio 的替代品,特别适合低配置或内存有限的用户。该服务提供对各种聊天、图像和视频模型的访问,无需本地安装,解决了在 Apple Silicon Mac 上运行大型模型时常见的内存限制问题。此基于云的解决方案提供与 OpenAI 兼容的 API,允许用户通过简单地更改基础 URL 来将其集成到现有的工作流程和应用程序中。
-
Hermes 3 405B 模型现已通过 LU Labs 托管服务提供
LU Labs 推出了 Hermes 3 405B 模型(一种需要大量计算资源的大型语言模型)的托管服务。该服务可通过基于 Web 的工作室或通过兼容 OpenAI 的 API 进行访问,允许用户将其与 SillyTavern、Aider 和 LibreChat 等现有工具集成。定价选项包括月度订阅或按量付费积分包,其他模型如 Hermes 3 70B 和 Qwen3 Coder 480B 也可使用。
-
OpenAI 声称在抄袭指控中取得数学突破;发布新 AI 模型
据报道,OpenAI 利用大量 AI 代理解决了长期存在的数学难题,取得了重大突破。然而,这一成就却被知识产权盗窃的指控所掩盖,有人声称 OpenAI 未能妥善归功于那些 AI 辅助工作为解决方案做出贡献的研究人员。这种情况引发了对人类数学家未来作用以及先进数学研究所需资源的疑问,可能导致此类能力集中在少数几家大型 AI 公司手中。与此同时,其他 AI 发展包括 Google 和 Meta 发布了旨在处理编码和代理工作流等日常任务的新…
-
OpenRouter 的免费 AI 模型提供编码帮助,但有严格限制
OpenRouter 的免费套餐提供访问多个用于编程任务的 AI 模型,但存在显著限制。新账户用户每分钟限制 20 个请求,每日上限为 50 个请求,在一次性购买 10 美元信用额度后,每日上限增加到 1000 个请求。可用的免费模型会定期轮换,这意味着特定的模型 ID 可能不会持续可用。在测试的模型中,Qwen3-Coder 480B 和 Kimi K2.6 因其强大的编码能力和大的上下文窗口而脱颖而出,而 Baidu Qianfa…
-
WebGrader 使用自演进评分器训练用于 Web 开发的大语言模型
研究人员推出了一种新颖的系统 WebGrader,旨在训练用于 Web 开发任务的大语言模型。这种自演进程序化评分器可自动从网站请求生成交互流程,并将其表示为可执行的 Flow Contracts。通过分离测试规划、动作接地、证据收集和语义判断,WebGrader 确保仅在观察到完整转换后才发出判决,从而提高了 WebGen-Bench 和 WG-core-250 等基准的函数成功率。
-
开源 AI 模型价格下降并新增排行榜
近期,多个开源 AI 模型被添加到追踪排行榜或大幅降价。Thinkingmachines 的 Inkling Small 因其大上下文窗口和有竞争力的定价而受到关注,Alibaba Group 的 Qwen3.7 Flash 也已被添加。此外,Qwen3 Coder 480B、GLM-5.2 和 Ling-3.0-flash 等模型价格大幅下降,表明开源 AI 解决方案市场竞争激烈。DeepSeek V4 Flash 0731 是另一…
-
中国AI模型价格比西方低50倍,性能不输 · 追踪4个来源
2026年AI API定价的比较显示,智谱AI、百度、DeepSeek和阿里巴巴集团等中国供应商提供的成本远低于OpenAI、Anthropic和Google等西方竞争对手。GLM 4.7 Flash等模型免费,而其他模型的价格比西方选项便宜几个数量级,且性能通常相当或更优。文章建议采用从更便宜的模型开始进行原型设计,并将模型复杂性与任务需求相匹配的策略来优化成本。
-
开发者使用9个AI代理实现经济高效的编码工作流
一位首席架构师开发了一种经济高效的编码工作流,该工作流使用多代理系统来利用不同的AI模型执行特定任务。这种称为“驱动开发”(Spec-Driven Development, SDD)的方法,为开发过程的九个阶段分配了不同的AI模型,以优化成本和能力。例如,DeepSeek V4 Flash用于初始存储库映射,而DeepSeek V4 Pro处理更复杂的规范和编码阶段,Qwen3-Coder则用于验证。
-
通过新的干预措施改进用于电力系统代码生成的大语言模型
研究人员开发了一种新方法,以提高基于大语言模型(LLM)的电力系统代码生成的可靠性,特别是在本地部署场景下。该方法通过引入一个名为PowerCodeBench的基准生成器和一种边界感知干预技术,来解决API知识边界错误,例如函数名称或参数不正确的问题。这种干预结合了API需求估计与文档注入和修正,显著提高了各种开源和商业LLM的准确性。