实体
Vid
Vid
PulseAugur coverage of Vid — every cluster mentioning Vid across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的ViD框架解决了视觉语言模型中的性别偏见问题
研究人员推出了一种新颖的框架ViD,旨在缓解大型视觉语言模型(LVLMs)中的性别偏见。与需要训练阶段调整或事后校准的先前方法不同,ViD通过分析注意力机制来动态解决视觉偏见,而无需额外的训练开销。该框架采用后门调整和精炼的token选择,以抑制源于强大语言先验的偏见,同时保持通用的推理和文本生成质量。ViD在FACET和MS COCO等基准测试中显著减少了性别偏见,尤其提升了LLaVA模型的性能。
-
新数据集支持从图像中估算人类力矩
研究人员推出了VID,这是一个新的数据集和基准,旨在直接从单目RGB图像中估算人类关节力矩。该方法旨在将生物力学分析从受控的实验室环境扩展到实际应用中,消除了对运动捕捉或力台等专用设备的需求。VID数据集包含同步的图像、运动学数据和生物力学标签,使得训练模型能够从视觉输入预测力矩。参考模型VID-Network在现有方法上取得了显著改进,误差减少了39.81%。