实体
MedASR
MedASR
PulseAugur coverage of MedASR — every cluster mentioning MedASR across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Whisper语音识别模型适配多语言医疗用途
研究人员分析了多语言医疗适配如何影响Whisper模型的内部表征。该研究比较了不同Whisper模型尺寸的各种微调策略,发现微调显著提高了MedASR的性能。在特定的诊断场景下,Whisper-Medium实现了最低的英语词错误率(WER),而Whisper-Large-v3实现了最低的德语WER。分析表明,英语医疗微调引起了编码器表征最显著的变化,而多语言延续在很大程度上保持了这些适配。
-
Google Research 更新用于医学影像的 MedGemma AI,推出 MedASR 语音模型
Google Research 发布了 MedGemma 1.5 4B,这是一个更新的、面向医疗保健的开放式生成式 AI 模型,增强了其解读 CT、MRI 和组织病理学等各种医学影像模式的能力。同时,他们还推出了 MedASR,一个专门针对医疗听写进行微调的新型开放式语音转文本模型。这些模型可免费用于研究和商业用途,Google 还通过 Kaggle 上的 100,000 美元 MedGemma Impact Challenge 黑客…