新的基准测试显示,Qwen3.8的推理能力需要巨大的计算成本,一项编码任务耗时11小时,一个SVG请求消耗了超过22000个token。禁用推理功能可显著减少token使用量和处理时间,这突显了在本地部署中高级推理与效率之间的权衡。与此同时,OpenRouter的估值大幅增长,在八个月内增长了五倍多,达到70多亿美元,为800万开发者提供服务,并支持访问400多个AI模型。 AI
影响 Qwen3.8等模型的先进推理的高成本可能会影响部署策略,而OpenRouter的快速估值增长表明投资者对AI基础设施平台充满信心。
排序理由 该集群涵盖了对前沿模型的重大成本分析以及AI平台的重大估值跃升。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →