Google DeepMind开发了一个名为SL2T的新AI模型,能够将手语转录为文本,并将集成到Pixel 11系列中。该技术旨在弥合聋哑和听障人士之间的沟通鸿沟,使他们能够使用手语执行诸如网络搜索、撰写消息和与AI聊天机器人互动等任务。该模型最初支持美国手语(ASL)到英语的转换,通过将视频转换为设备上的线框图,然后在服务器端进行翻译来处理视频,以保护用户隐私。 AI
影响 通过在智能手机上启用手语输入,增强了聋哑和听障用户的可访问性。
排序理由 这是消费设备的一项新功能,而不是核心AI模型发布。
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 9 个来源。 我们如何撰写摘要 →