PulseAugur
实时 02:48:55
实体 SmolVLA

SmolVLA

PulseAugur coverage of SmolVLA — every cluster mentioning SmolVLA across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 4
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_185278 ·

    新的GUARD方法可检测扩散模型视觉-语言-动作策略的故障

    研究人员开发了GUARD,一种用于检测扩散模型视觉-语言-动作(VLA)策略故障的新颖方法。GUARD在测试时通过分析模型键值缓存中特定token对生成动作的影响来工作。它通过创建关键条目被烧蚀的反事实场景,并将由此产生的去噪响应与原始响应进行比较来实现这一点。这种方法产生了敏感性、注意力熵、模态偏差和接地效率等诊断流,然后由一个轻量级的时间分类器处理以识别潜在的故障。

  2. TOOL · CL_129266 ·

    新框架增强轻量级机器人控制模型

    研究人员开发了XS-VLA,一个新颖的两阶段框架,旨在利用轻量级视觉语言模型增强机器人控制。该框架解决了大型模型在实时应用中的局限性以及小型模型的“空间盲区”问题。XS-VLA首先将来自大型模型Qwen3-VL-4B的空间知识蒸馏到一个小型SmolVLM2-0.25B骨干网络中,以提高其空间基础能力。然后,这个增强的骨干网络会条件化一个潜在流匹配策略,该策略使用CVAE和流匹配动力学来建模复杂的动作分布。

  3. TOOL · CL_129072 ·

    CorridorVLA 为生成式动作模型引入显式空间约束

    研究人员引入了 CorridorVLA,一种新颖的视觉-语言-动作 (VLA) 模型方法,该方法显式地纳入了空间约束。与先前隐式嵌入空间指导的方法不同,CorridorVLA 将稀疏空间锚点预测为增量物理变化。这些锚点定义了一个容差走廊,通过走廊外的轨迹的校正梯度和走廊内的轨迹的精炼目标来指导动作生成过程。该方法在 LIBERO 和 LIBERO-Plus 等基准测试中取得了显著的改进,其中一个策略在多任务设置中实现了 83.21% 的成功率。

  4. RESEARCH · CL_128533 ·

    数据投毒攻击被发现对开源机器人模型具有实用性和隐蔽性

    研究人员已经证明,对开源机器人模型进行数据投毒攻击是实用且隐蔽的。通过在训练数据中注入少量受污染的样本,可以在像smolVLA这样的视觉语言动作模型中嵌入后门。即使在使用干净的提示时,此后门也可以根据指令禁用机器人或显著降低其在特定任务上的性能。这些发现突显了在开源机器人技术中需要更加关注数据集的来源。

  5. TOOL · CL_117766 ·

    新型AI系统通过视觉和语言自动化生物实验室任务

    研究人员开发了BioProVLA-Agent,一个经济实惠的系统,用于使用视觉-语言-动作(VLA)模型自动化生物实验室任务。该系统集成了协议解析、视觉状态验证和具身执行,以处理非结构化协议和具有挑战性的视觉条件,如透明实验室器皿和反射。该系统在15个原子任务、6个复合工作流和3个双臂任务的基准上进行了性能评估,显示出更高的稳定性和精度,尤其是在视觉退化的环境中。