Cerebras 和 Gimlet Labs 正在合作,利用 Cerebras 技术建立约 100 兆瓦的 AI 推理算力。该基础设施的目标是实现每秒高达 3,000 个 token 的输出。然而,两家公司强调,峰值 token 速度并非生产就绪的唯一指标,全面的评估应包括首个 token 延迟、并发性、多芯片推理、可靠性和成本等因素。 AI
影响 此次合作标志着向更大规模、专用 AI 推理基础设施的转变,可能影响云服务提供商的产品和 AI 部署成本。
排序理由 两家公司合作建设大规模 AI 基础设施。[lever_c_从显著降级:ic=1 ai=0.7]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →