PulseAugur
实时 03:40:59
实体 Sori-1B

Sori-1B

PulseAugur coverage of Sori-1B — every cluster mentioning Sori-1B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_226735 ·

    Sori-1B:从零开始训练的音频基础语言模型

    来自SNU的一位研究员开发了一个名为Sori-1B的新的10亿参数音频语言模型。与典型模型不同,Sori-1B的解码器完全从零开始在音频配对文本上进行训练,旨在将其响应与音频联系起来,而不是依赖纯文本先验。该模型重用了NVIDIA的冻结的Audio Flamingo Next编码器,并使用三块RTX 4090 GPU在约7.4k小时的数据上进行了训练。Sori-1B支持多种模式,包括多项选择题、开放式问题、字幕生成和自动语音识别,但其…