实体
Qwen 0.5B
Qwen 0.5B
PulseAugur coverage of Qwen 0.5B — every cluster mentioning Qwen 0.5B across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
新的VLA框架推动自动驾驶感知和动作规划 · 跟踪9个来源
多篇研究论文介绍了用于自动驾驶的新型框架,这些框架集成了视觉、语言和动作(VLA)能力。MATS提出了一种多模态、多任务学习方法,具有自适应融合和特定任务的专家,用于3D感知。HyWorldVLA结合了像素级监督和基于潜在变量的世界模型以实现鲁棒驾驶,而PerceptDrive则利用冻结的感知模型和自适应专家路由。ForgeDrive使用统一的扩散框架和交叉条件进行视觉-动作生成,MindDrive则采用在线强化学习和大型语言模型进行…
-
AI模型权重显示局部线性结构演变
研究人员调查了神经网络权重和激活中线性结构 Nature,发现虽然存在局部低秩结构,但它们并非稳态。这项在 DistilGPT-2 和 Qwen-0.5B 等合成 Transformer 和 LLM 上进行的研究表明,有用的基在短时间训练期间会显著漂移。然而,初始恢复更新可以捕获大部分位移,表明是局部几何形状的演变,而非全局任务方向。
-
Hugging Face 模拟使用多样化的小型模型进行金融游戏
新版“千元木材”模拟游戏已发布,将其转变为一款互动式金融游戏。玩家扮演影子金融家,操纵一个由林地生物组成但每个生物都使用不同的小型语言模型进行决策的市场。这种多模型方法突显了服务多样化 AI 代理的挑战和解决方案,主要障碍存在于服务层而非模型本身。