PulseAugur
实时 09:18:09
实体 Qwen-VLA

Qwen-VLA

PulseAugur coverage of Qwen-VLA — every cluster mentioning Qwen-VLA across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 4 条
  1. SIGNIFICANT · CL_153226 ·

    OpenBMB发布用于设备端机器人的MiniCPM-Robot模型

    OpenBMB发布了两个新模型MiniCPM-RobotTrack和MiniCPM-RobotManip,专为机器人设备端AI设计。MiniCPM-RobotTrack专注于语言条件下的目标跟踪,利用融合的视觉特征预测未来航点,并实现高效的设备端推理。MiniCPM-RobotManip是一个更大、更通用的视觉-语言-动作模型,用于具身操作,性能优于其他模型,并具有流式上下文功能,可用于长视域决策并减少计算量。

  2. RESEARCH · CL_147882 ·

    新模型RxBrain和GTA-VLA推动具身AI推理发展

    研究人员推出了RxBrain,一个新颖的具身认知基础模型,它整合了语言和视觉推理能力以进行规划。与专注于场景理解或未来状态预测的现有模型不同,RxBrain将具身计划表示为一个统一的序列,利用语言来提供抽象结构,并利用视觉想象来 grounding 在物理状态中。该模型采用了Transformer混合架构,即使在没有大量动作数据预训练的情况下,在连续机器人动作生成方面也表现出有希望的性能。此外,还提出了一个名为GTA-VLA的新框架,…

  3. FRONTIER RELEASE · CL_64608 ·

    阿里巴巴发布 Qwen3.7-Plus 多模态智能体模型

    阿里巴巴的 Qwen 团队发布了 Qwen3.7-Plus,这是一款除了文本之外,还能理解图像和视频的多模态大语言模型。该新模型增强了视觉能力,并保留了深度推理、自编程、工具调用和自主迭代等智能体功能。Qwen3.7-Plus 可通过阿里云的“百炼”平台获取,标志着阿里巴巴在具身智能领域为实际应用迈出了重要一步。

  4. SIGNIFICANT · CL_60176 ·

    Qwen发布Qwen-VLA,用于具身AI行动

    Qwen推出了Qwen-VLA,一个多模态大语言模型,专为具身智能设计。该模型超越了仅仅理解图像和视频等视觉信息的能力,旨在使智能体能够在现实世界中采取行动。Qwen-VLA被定位为创造能够感知并与环境互动之智能体的一步。