PulseAugur
实时 03:26:17
中文(ZH) MiniMax H3正式发布

MiniMax 发布 H3,一款具备音视频输出的多模态生成模型

MiniMax 已正式推出其新的通用多模态生成模型 MiniMax H3。该模型能够理解包括文本、图像、视频和声音在内的统一多模态上下文,并能以 2K 分辨率输出长达 15 秒的原生双通道音视频内容。MiniMax 计划在未来几天内发布模型权重,并遵守相关法律法规。 AI

影响 这款新的多模态模型有望推动 AI 处理和生成复杂、集成媒体格式的能力。

排序理由 前沿实验室模型发布,附带系统卡。[lever_c_从 frontier_release 降级:ic=1 ai=1.0]

在 36氪 (36Kr) 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

MiniMax 发布 H3,一款具备音视频输出的多模态生成模型

报道来源 [1]

  1. 36氪 (36Kr) TIER_1 中文(ZH) ·

    MiniMax H3 正式发布

    36氪获悉,MiniMax宣布正式发布MiniMax H3。据介绍,这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持15s 2K分辨率。MiniMax表示,计划在未来几天内,在符合相关法律法规的前提下,开放模型权重。