8月3日,大模型公司MiniMax(稀宇科技,00100.HK)正式开源了新一代通用视频模型MiniMax H3,在Artificial Analysis榜单中视频编辑能力排名全球第一。
据了解,MiniMax H3系统由H3-Context-IR、H3-Base、H3-Regenerate-2K三个模块组成,它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒并带有原生立体声音频的视频。而这得益于MiniMax H3在预训练阶段就已具备广泛的多模态上下文理解与生成能力,因此能出色地遵循复杂的多模态指令。
《中国经营报》注意到,华为昇腾、摩尔线程、沐曦股份、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub、fal等开发社区和云推理平台,另有vLLM-Omni、SGLang等推理框架,均在MiniMax H3开源同日完成了相关适配支持。开发者可以直接从Hugging Face下载MiniMax H3模型,其中H3-Base目前支持通过SGLang、vLLM、diffusers和ComfyUI等推理框架和工作流进行部署。
(文章来源:中国经营报)
文章来源:中国经营报
原标题:MiniMax H3正式开源 视频编辑能力全球第一
