Qwen-VLA
PulseAugur coverage of Qwen-VLA — every cluster mentioning Qwen-VLA across labs, papers, and developer communities, ranked by signal.
-
OpenBMB releases MiniCPM-Robot models for on-device robotics
OpenBMB has released two new models, MiniCPM-RobotTrack and MiniCPM-RobotManip, designed for on-device AI in robotics. MiniCPM-RobotTrack focuses on language-conditioned target tracking, utilizing fused visual features …
-
New models RxBrain and GTA-VLA advance embodied AI reasoning
Researchers have introduced RxBrain, a novel foundation model for embodied cognition that integrates language and visual reasoning for planning. Unlike existing models that focus on scene understanding or future state p…
-
Alibaba launches Qwen3.7-Plus multimodal agent model
Alibaba's Qwen team has released Qwen3.7-Plus, a multimodal large language model that can understand images and video, in addition to text. This new model enhances vision capabilities and maintains agentic functions lik…
-
Qwen unveils Qwen-VLA for embodied AI action
Qwen has introduced Qwen-VLA, a multimodal large language model designed for embodied intelligence. This model goes beyond simply understanding visual information like images and videos, aiming to enable agents to act w…