研究人员开发了使用深度图像衍生的点云进行标志性语言识别的新模型。该研究比较了使用PointNet架构和原始及合成生成的深度图像的分类准确性。使用了三个数据集——实时ASL拼写、KArSL和AUTSL,模型采用了基于帧、点手势图和长短期记忆数据结构。虽然基于原始深度数据的模型通常优于合成数据模型,但一些合成模型表现更优。 AI
影响 这项研究有助于改进标志性语言识别技术,可能有助于提高沟通的可及性。
排序理由 详细介绍标志性语言识别新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- AUTSL
- Depth Anything V2
- Karslake
- long short-term memory
- Point Gesture Map
- PointNet
- Real-time ASL Fingerspelling
- Rüstem Özakar
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →