MiniMax H3正式开源:视频编辑能力全球第一

2026-08-03 13:36:40
18407
8月3日,MiniMax正式开源新一代通用多模态生成模型MiniMax H3。

8月3日,MiniMax正式开源新一代通用多模态生成模型MiniMax H3。华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭Model Scope、Comfy UI、Running Hub等开发社区和云推理平台,均在H3开源同日完成了相关适配支持。

H3是一个通用型全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。模型由H3-Context-IR(多模态指令理解系统)、H3-Base(768p音视频生成)和H3-Regenerate-2K(2K高分辨率重生成)三个模块组成。

在权威视频模型榜单ArtificialAnalysis中,H3在视频编辑能力项排名全球第一,文生视频、图生视频能力分别位居第二、第三名。其跨模态复合参考能力尤为突出——用户可输入最多9张图像、3段视频和3段音频作为参考素材,模型能够综合理解不同素材中的画面构图、场景、人物和声音,并按要求生成连贯的音视频内容。

定价方面,H3默认2K分辨率,每秒定价仅0.8元人民币,在同级别产品中具备较强的价格竞争力。模型基于MiniMax H3Community License发布,开发者可直接从Hugging Face下载模型权重,H3-Base目前支持通过SGLang、vLLM、diffusers和Comfy UI等推理框架和工作流进行部署。

免责声明:本文观点来自原作者,不代表天天在线的观点和立场。文章内容仅供参考、交流、学习,不构成投资建议
责任编辑:蓝羽_XN054
猜你感兴趣