MiniMax 开放 H3 全模态系统,可生成带原生立体声的视频
MiniMax-H3
MiniMax 发布 H3 通用全模态系统,支持文本、图像、视频、音频输入,并生成最长 15 秒、最高 2K、带原生立体声的视频。
一分钟读懂
MiniMax 发布 H3 通用全模态系统,支持文本、图像、视频、音频输入,并生成最长 15 秒、最高 2K、带原生立体声的视频。
H3 接收文本、图像、视频和音频输入,并输出带音频的视频。
多模态系统开始把理解与视听生成合并进同一产品栈,为创作与 Agent 工作流提供新的本地和可定制路径。
这件事情本身是什么
H3 接收文本、图像、视频和音频输入,并输出带音频的视频。
官方模型卡给出最高 2K、最长 15 秒和原生立体声等能力边界。
部分上下文组件并未随开源版本完整提供,许可证也不是标准 OSI 开源许可证。
