实体
Unified Multimodal Model
Unified Multimodal Model
PulseAugur coverage of Unified Multimodal Model — every cluster mentioning Unified Multimodal Model across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
ToolArtist 模型集成了推理、工具使用和图像生成
研究人员推出 ToolArtist,这是一种新颖的代理图像生成模型,旨在克服当前文本到图像系统的局限性。与具有固定工作流程或部分代理控制的先前模型不同,ToolArtist 将推理、外部工具使用和图像生成整合到一个统一的策略中。这是通过使用搜索和图像生成工具进行监督微调来训练统一多模态模型 (UMM),然后使用一种称为 Reason-Act-Draw GRPO (RAD-GRPO) 的新方法进行强化学习来实现的。实验表明,这种完全代理…
-
Anticipation-VLA 模型通过自适应子目标解决长时域机器人任务
研究人员开发了 Anticipation-VLA,这是一种新颖的层次化视觉-语言-动作 (VLA) 模型,旨在解决长时域具身任务。与使用固定子任务粒度的方法不同,Anticipation-VLA 根据任务不断变化的状态自适应地生成未来的子目标。这种自适应子目标生成是通过对用于高级规划的统一多模态模型和用于动作执行的面向目标的 VLA 策略进行微调来实现的。在模拟和现实世界机器人技术中的实验都证明了该模型在提高鲁棒策略执行方面的有效性。