实体
GigaAM Multilingual
GigaAM Multilingual
PulseAugur coverage of GigaAM Multilingual — every cluster mentioning GigaAM Multilingual across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
Sber发布开源GigaChat Audio,支持情绪检测和时间戳
Sber更新了其GigaChat Audio模型,增强了其直接处理音频文件而无需完整转录的能力,并能检测语音中的情绪基调。更新后的模型现在可以识别说话人、总结内容,并在长达三小时的录音中为特定时刻提供时间戳。此外,Sber还发布了开源版本GigaChat3.1-Audio-10B,以及支持多种语言的GigaAM多语言语音识别系列。
-
ai-sage 发布 GigaAM Multilingual 语音模型
ai-sage 发布了 GigaAM Multilingual,这是一系列基于 Conformer 的基础模型。这些模型有 2.2 亿和 6 亿参数的变体,已在超过 70 种语言的 200 万小时以上语音数据上进行了预训练。它们针对自动语音识别 (ASR) 进行了微调,在俄语、哈萨克语、吉尔吉斯语和乌兹别克语方面提供顶级开源性能,在英语方面性能中等。