American Sign Language
PulseAugur coverage of American Sign Language — every cluster mentioning American Sign Language across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
Netflix 通过 Chrome 扩展为 73 部儿童作品添加 ASL 解读
Netflix 通过为 73 部儿童作品(包括节目和电影)添加美国手语 (ASL) 解读,扩展了其无障碍功能。这项与 SignUp Media 合作的举措通过 Google Chrome 扩展程序提供 ASL 解读,允许用户在单独的窗口中观看口译员。此举旨在提高听障儿童的读写能力和可及性,并借鉴了 SignUp Media 此前在“奥斯卡项目”上的工作。
-
AI模型在手语识别中展现出涌现的音位敏感性
一项新的研究论文调查了为手语识别(SLR)训练的深度学习模型在音位感知能力,特别关注美国手语(ASL)。该研究使用最小对探查模型,并将其表征与人类行为数据进行比较。研究结果表明,虽然SLR模型展现出涌现的音位敏感性,但其性能受到架构偏差的影响,姿态(pose-based)模型在手形识别方面表现出色,而像素(pixel-based)模型在位置变化方面表现出色。姿态模型也与人类感知判断表现出中等程度的相关性。
-
新研究分析了对话如何在STEM话语中缩短美国手语的表达
研究人员开发了一种新方法来研究对话背景如何影响STEM话语中美国手语(ASL)的发音。通过收集ASL对话的动作捕捉数据,他们观察到对话中使用的手语明显更短,并且表现出在独白或解读讲座中不存在的缩减。本研究旨在通过理解手语发音的语用学塑造来改进手语技术。
-
麻省理工学院腕带利用超声波教会机器人人类的灵巧性
麻省理工学院的研究人员开发了一种超声波腕带,可以捕捉人类的手部和肌肉运动。然后,这些数据被用来训练机器人,使它们能够以更高的灵巧性执行家务和手术等复杂任务。该系统利用AI来解码捕捉到的运动,使机械手能够近乎实时地模仿手势。未来的应用可能包括创建大型数据集,以训练机器人自主学习精细运动技能。
-
使用合成数据开发的直接手语翻译模型
研究人员开发了一种新颖的直接翻译不同手语的方法,填补了当前手语技术的空白。他们的方法利用反向翻译创建合成平行语料库,从而能够训练一个模型同时进行文本到手语和手语到手语的翻译。这种直接方法在准确性和速度上显著优于级联系统,有望改善聋哑和听障人士之间的跨语言交流。
-
AI驱动的戒指可将手语翻译的准确率提高到88%
研究人员开发了电子戒指,可以通过无线传输运动数据到AI系统来解读手语。与之前的基于摄像头或智能手套的系统不同,这些戒指为实际应用提供了更实用、更轻便、更舒适的解决方案。该系统使用七个配备加速度计的戒指和一个深度学习模型,在识别美国手语和国际手语的常用词汇方面达到了88%以上的准确率,即使对于未参与初始训练的用户也是如此。
-
新的基于集合的分组配准框架可泛化至不同心脏MRI协议
研究人员开发了一种名为 \AnyTwoReg 的新型基于集合的分组配准框架,用于心脏MRI序列。该方法将输入数据视为无序集合,将网络设计与序列长度和输入顺序解耦。通过使用共享编码器和来自基础模型的对比度不敏感特征,它实现了跨不同MRI协议和对比度变化的泛化。该框架展示了强大的零样本跨协议泛化能力,并提高了下游定量映射的质量。
-
神经形态系统实现低延迟、高能效的手语识别
研究人员开发了一种新颖的用于美国手语(ASL)识别的神经形态架构,将脉冲视觉注意力机制与SpiNNaker平台上的紧凑型脉冲神经网络相结合。该系统实现了低延迟和高能效,在模拟和硬件部署上均展现出有竞争力的准确性。该架构专为边缘部署而设计,展示了神经形态计算在实时、功耗受限应用中的潜力。
-
Apple AI引导手语标注,降低成本并改进模型
来自Apple和Gallaudet University的研究人员开发了一种伪标注管道,以显著降低标注手语数据所需的成本和时间。这种新方法使用手语模型的稀疏预测和K-Shot LLM方法来估计手语词汇、拼写词和手语分类器的标注。该管道旨在克服数据稀缺性这一限制AI驱动的手语解释的难题,一位专业翻译员在近500个视频上验证了该方法。