Google 更新了其 Gemini 3.8 Flash 模型,引入了低、中、高三个不同的思考层级。这些层级控制模型在响应前进行的内部推理量,从而影响延迟、令牌使用量和成本。与前代 Gemini 3.7 Flash 不同,3.8 Flash 模型默认设置为中等层级,并且不再支持“最小”思考层级,该层级为便于迁移已映射到“低”层级。建议开发者为每个用例明确设置思考层级,以有效管理成本和性能。 AI
影响 Gemini 3.8 Flash 中的新思考层级控制为开发者提供了对不同任务成本和性能更精细化的管理。
排序理由 前沿实验室(Google)的模型发布。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →