品玩

科技创新者的每日必读

打开APP
关闭

视频生成进入生产力时代,MiniMax H3 发布

7小时前

7 月 31 日,MiniMax 发布新一代多模态生成模型 MiniMax H3,并宣布近期开源。

作为 MiniMax 从“特化任务模型”迈向“通用多模态智能”的重要探索,H3 不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。

MiniMax H3 支持文本、图片、音频和视频等多种输入形式,支持 2K 分辨率直出,可生成最长 15 秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。

在模型效果方面,MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。

在 Artificial Analysis 视频模型榜单中,MiniMax H3 在视频编辑能力项排名全球第一。

自成立以来,MiniMax 坚持文本与多模态模型并行自研,已先后开源三代 M 系列文本模型。H3 则是MiniMax推出的首款开源多模态生成模型。

H3 借鉴了文本模型发展过程中已经被验证的方法,包括复杂问题拆解、Reasoning、Scaling Context 和 Muon 优化器等,并将其应用到多模态理解、数据构建和模型训练中。围绕不同任务的理解和指令遵循,MiniMax 对数据体系进行了多轮迭代,提升模型面对开放输入和复杂指令时的泛化能力。

MiniMax H3 视频生成价格为 0.8 元/秒(2K分辨率),仅为业内同类旗舰视频模型的三分之一。MiniMax 通过高压缩 Tokenizer 降低视频生成所需的 Token 数量,实现了成本优化与效率的提升。针对视频长度、分辨率和多模态理解与生成负载差异较大的特点,MiniMax 在异构训练、负载均衡和 GPU 利用效率等方面进行系统优化,在追求模型效果的同时控制训练和推理成本。

MiniMax H3 将业内多模态模型的竞争进一步带向效果、成本、开放性与生态协同的综合维度,丰富了模型企业与国产 AI 芯片软硬件协同生态。与此同时,MiniMax 多模态路线进入了模型能力、训练效率、开源生态和行业应用协同推进的新阶段。

“通过 MiniMax H3,我们希望为更多企业和开发者、创作者降低内容创作的门槛。H3 将于未来几天内开源,企业可以在本地灵活部署,结合自身数据和业务进行优化,更好地满足安全合规要求;芯片厂商和开发者也能共同参与适配和优化,降低使用成本,扩大应用范围。”MiniMax相关负责人表示,“我们会持续推动优秀的文本、多模态模型从过往的封闭服务,走向更加开放、可协作的产业生态。”

取消 发布

下载品玩App,比99.9%的人更先知道关于「MiniMax」的新故事

下载品玩App

比99.9%的人更先知道关于「MiniMax」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测