PulseAugur
实时 09:16:37
English(EN) D\'ej\`a Cue: Localizing States in Object Histories via Vocabulary-Relative Coordinates

Déjà Cue 框架使用词汇相对坐标进行对象状态检索

研究人员开发了 Déjà Cue,一个旨在改进视觉历史中对象状态定位的新颖框架。这种无需训练的方法利用词汇相对坐标,有效地使用替代状态描述作为参考系统。通过减去状态平衡的质心和校准帧分数,Déjà Cue 增强了识别描述状态成立的特定时间间隔的能力。在 VOST 数据集上的实验表明,检索精度显著提高,R@1 分数几乎翻倍,tIoU Top-1 也有所增加。 AI

影响 改进了视觉对象跟踪中的状态定位,可能增强那些依赖于随时间理解对象状态的 AI 系统。

排序理由 该集群包含一篇详细介绍新框架和方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.LG 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Déjà Cue 框架使用词汇相对坐标进行对象状态检索

报道来源 [1]

  1. arXiv cs.LG TIER_1 English(EN) · Haofan Cao, Zhichao You, Yunkai Yang, Liang Guo, Jie Wang, Chongshou Li ·

    D\'ej\`a Cue: Localizing States in Object Histories via Vocabulary-Relative Coordinates

    arXiv:2608.02044v1 Announce Type: cross Abstract: Tracking links observations of the same object through visual change, yet cannot by itself determine when the object is empty or filled, intact or cut. We formulate identity-conditioned state-moment retrieval: given a tracked-obje…