Alibaba发布了升级版语音识别模型Qwen-Audio-3.0-ASR-Flash。新版本增强了长音频的上下文一致性,无需手动列表即可识别行业特定术语,并为常用术语提供更准确的定制。此外,该模型现在可以执行语音优化,一步完成去除填充词和将口语结构化为连贯文本。 AI
影响 此次发布提高了语音转文本应用的准确性和效率,尤其适用于长篇内容和专业行业。
排序理由 Frontier-lab模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →