PulseAugur
实时 09:03:14
Русский(RU) GigaChat Audio научился распознавать эмоции и находить нужные моменты в трёхчасовых записях: gigachat open source

Sber发布开源GigaChat Audio,支持情绪检测和时间戳

Sber更新了其GigaChat Audio模型,增强了其直接处理音频文件而无需完整转录的能力,并能检测语音中的情绪基调。更新后的模型现在可以识别说话人、总结内容,并在长达三小时的录音中为特定时刻提供时间戳。此外,Sber还发布了开源版本GigaChat3.1-Audio-10B,以及支持多种语言的GigaAM多语言语音识别系列。 AI

影响 此次发布增强了开发者的音频处理能力,可能改进会议摘要和通话分析等应用。

排序理由 该集群描述了来自主要AI实验室(Sber)的新模型发布和开源可用性。[lever_c_demoted from frontier_release: ic=1 ai=1.0]

在 dev.to — LLM tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Sber发布开源GigaChat Audio,支持情绪检测和时间戳

报道来源 [1]

  1. dev.to — LLM tag TIER_1 Русский(RU) · Promptra Team ·

    GigaChat Audio学会识别情绪并在三小时录音中找到相关时刻:gigachat开源

    <p>14 июля 2026 года Сбер обновил аудиомодель в своём ИИ-помощнике и выложил облегчённую версию для разработчиков. Главное, что изменилось на практике: модель работает с голосом и аудиофайлами напрямую, без обязательной предварительной расшифровки всей записи в текст, ловит позит…