返回行业动态

MiniMax 发布全能多模态生成模型 H3,支持 2K 原生立体声视频

2026/07/31 10:34
查看原文

OmniTools 7月31日消息,MiniMax 正式推出全能多模态生成模型 H3,支持文本、图像、视频与音频的联合理解与生成。该模型可生成最高 2K 分辨率、时长 15 秒且带原生立体声的视频。

H3 在指令跟随能力、文字与品牌元素呈现、视频到视频(V2V)动作迁移等任务上表现突出。在定价方面,2K 分辨率下每秒生成成本低于主流模型约三分之一,768p 分辨率下则低于主流 720p 模型约一半。

MiniMax 表示将尽快开源 H3 模型权重,以推动开源社区发展并提升硬件适配效率。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部