PulseAugur
中
实时 15:54:53
实体 Vietnamese Visual Question Answering

Vietnamese Visual Question Answering

PulseAugur coverage of Vietnamese Visual Question Answering — every cluster mentioning Vietnamese Visual Question Answering across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_275452 ·

    新型Transformer模型增强越南语视觉问答能力

    研究人员开发了一种新颖的多层融合Transformer模型,旨在增强越南语视觉问答(VQA)能力。该模型采用交叉注意力机制,有效整合来自不同层的视觉和文本信息,使其能够捕捉从低到高抽象级别的信息。所提出的架构旨在弥合除英语以外的语言在VQA研究中存在的差距,特别关注越南语。实验结果表明,该模型在ViVQA数据集上取得了与现有基线相比具有竞争力的性能。