近期,多家主要大语言模型提供商调整了其定价结构,其中一些促销活动即将到期。Google的Gemini 3.7 Flash最初价格减半,但将在2027年翻倍,这一细节在最初的报道中很大程度上被忽略了。DeepSeek为其V4 Pro模型引入了峰值和非峰值定价,显著增加了对缓存命中输入的成本,而缓存命中输入对于代理循环至关重要。该公司的定价以UTC为准,需要进行换算才能准确评估本地成本。与此同时,Qwen发布了其Qwen3.8-27B模型,采用Apache 2.0许可证,随着API价格的波动,这可能提供一个更稳定的成本选择。 AI
影响 大语言模型的API成本正变得日益复杂且可能不稳定,这要求代理应用程序进行仔细的预算规划和系统设计。
排序理由 对大语言模型定价变化及其影响的分析,而非来自前沿实验室的直接公告。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →