PulseAugur
实时 17:56:25
English(EN) Everyone reported the 50% price cut. Nobody mentioned it expires.

大语言模型定价变化:Google的Gemini Flash翻倍,DeepSeek引入峰值/非峰值定价

近期,多家主要大语言模型提供商调整了其定价结构,其中一些促销活动即将到期。Google的Gemini 3.7 Flash最初价格减半,但将在2027年翻倍,这一细节在最初的报道中很大程度上被忽略了。DeepSeek为其V4 Pro模型引入了峰值和非峰值定价,显著增加了对缓存命中输入的成本,而缓存命中输入对于代理循环至关重要。该公司的定价以UTC为准,需要进行换算才能准确评估本地成本。与此同时,Qwen发布了其Qwen3.8-27B模型,采用Apache 2.0许可证,随着API价格的波动,这可能提供一个更稳定的成本选择。 AI

影响 大语言模型的API成本正变得日益复杂且可能不稳定,这要求代理应用程序进行仔细的预算规划和系统设计。

排序理由 对大语言模型定价变化及其影响的分析,而非来自前沿实验室的直接公告。

在 dev.to — LLM tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

大语言模型定价变化:Google的Gemini Flash翻倍,DeepSeek引入峰值/非峰值定价

报道来源 [1]

  1. dev.to — LLM tag TIER_1 English(EN) · LucioLiu ·

    所有人都报道了降价50%。没人提到它会过期。

    <p>Three pricing stories landed this week. They got reported separately. Read together, they point the same way.</p> <h2> What got reported </h2> <p>Google launched Gemini 3.7 Flash at $0.75 per million input tokens and $3.75 output. Roughly half the previous Flash cost. That was…