OpenAI 推出了其 GPT-6 Astra 模型的新服务层“超快”,提供显著更快的 token 生成速度,但价格增加了六倍。这个高级速度层对所有 API 用户开放,企业客户有更高的额度。虽然模型本身保持不变,“超快”层旨在降低对时间敏感型应用的延迟,但不建议用于批量处理。OpenAI 还预览了 GPT-5.6 Sol 的“超快”功能,并计划支持 GPT-6.1 Sol,这些模型的定价细节尚未公布。 AI
影响 这个高级速度层可能会加速对延迟敏感型 AI 应用的采用,但其高昂的成本需要仔细的成本效益分析。
排序理由 这是现有模型的新服务层,而不是新模型发布。
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →