Induction Labs 推出了 Photon-1,这是一个拥有 1060 亿参数的混合专家模型,在没有动作标签的原始视频上进行训练。这种“想象模型”架构在学习到的表示空间中预测未来帧,使其能够隐式地推断动作。据报道,Photon-1 在内部基准测试中表现优于 Gemini 3.1 Flash-Lite,使用的预训练计算量显著减少,服务成本也更低。该模型通过编码帧差实现了高压缩率,并使用 PyTorch 在 5.75 亿帧上进行了训练,展示了 H200 GPU 的高效利用。 AI
影响 通过展示无需显式动作标签即可完成任务,为代理训练设定了新方向,可能减少数据需求。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c 从 frontier_release 降级:ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →