PulseAugur
实时 09:29:30
实体 Text2Reward

Text2Reward

PulseAugur coverage of Text2Reward — every cluster mentioning Text2Reward across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_245021 ·

    大型语言模型生成四足机器人运动的正式规范

    研究人员开发了一种新颖的方法,利用大型语言模型(LLMs)生成正式规范来训练四足机器人行走。LLMs(如GPT-5.5和Qwen 3.6)根据自然语言目标提出参数信号时序逻辑(PSTL)规范,而不是手动设计奖励函数。然后,这些生成的规范经过优化并用于训练运动策略,在指令跟踪和步态控制方面取得了优于其他方法的性能。