实体
lockbox
lockbox
PulseAugur coverage of lockbox — every cluster mentioning lockbox across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
AI研究揭示观察保真度、意识和推理可靠性方面的反直觉发现
新研究表明,提高观察保真度会适得其反地损害具身大型语言模型(LLM)的解决问题能力,一项研究发现原始RGB输入比完美的地面真实数据更有效。另一篇论文探讨了一个评估AI意识的框架,表明意识的指标与通用智能所需的特征重叠。此外,关于LLM推理的研究表明,虽然强化学习可以提高性能,但它也可能导致“长度分配不当”,即模型在简单任务上花费过多时间,而在复杂任务上花费时间不足,并且启用“推理模式”有时会使模型更容易出错。
-
具身大语言模型在处理嘈杂、原始视觉输入时表现优于完美数据
一项新的研究论文探讨了大语言模型(LLMs)集成到机器人系统中后在复杂任务上的表现。研究发现,为LLMs提供原始RGB视觉输入比提供完美的、真实标记的符号化观察结果更能解决问题。与直觉相反,在观察结果中引入适度的噪声或随机错误实际上提高了LLMs的性能,减少了重复性动作循环并提高了成功率。