腾讯发布了Prism,一款与复旦大学合作开发的新型视频和音频生成模型。该模型支持原生2K分辨率,并集成了音频生成功能,据称在演示中表现优于Kling 3和Wan 3.0等其他模型。Prism采用新颖的动态稀疏注意力机制以加快训练速度,并以MIT许可发布,尽管目前高分辨率生成需要大量的GPU资源。 AI
影响 此次发布为高分辨率视频和音频生成提供了一个新的开源选项,有望加速多模态AI领域的创意工作流程和研究。
排序理由 该集群报道了一家主要科技公司(Tencent)发布新AI模型(Prism)的消息,包括其功能和许可的详细信息。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →