Tencent Hunyuan 与复旦大学发布了 Prism,一个能够同时生成原生 2K 视频和音频的新 AI 模型。该模型采用了一种新颖的动态稀疏注意力机制,据称能够以提高的质量实现 2.5 倍的训练速度。Prism 以 MIT 许可发布,并提供了训练和微调代码,但更高分辨率需要多块高端 GPU。 AI
影响 以开源许可设定了集成视听 AI 生成的新标准,可能加速多媒体 AI 的研究和开发。
排序理由 前沿实验室模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →