返回AI 模型
AI 模型

MiniMax H3开源全模态视频模型:手绘特效端到端直出,默认2K画质

MiniMax正式开源H3全模态视频模型,将后期编辑流程融入生成环节,默认2K清晰度,支持手绘草图直接生成花体字、字幕动画等视频特效,是国内首个开源全模态视频模型。

19 阅读作者:新品星球编辑部

7月31日,MiniMax发布全新一代视频模型H3,并同步在ModelScope和Hugging Face开源。这是国内首个开源的全模态视频模型,将后期编辑能力直接内置到生成环节,打破了视频模型'只提供素材'的既有范式。

H3的差异化能力体现在三个层面:第一,手绘特效端到端生成,用户只需画几笔草图,模型即可直接输出花体字、字幕动画、动态贴纸等2K清晰度的视频片段;第二,统一多模态上下文,将文本、图像、视频、音频纳入同一处理流程,跨模态协同更自然;第三,开源生态策略,团队明确表示将持续推进权重开放,大幅降低多模态视频模型的开发门槛。

与同日发布的字节Seedance 2.5相比,H3在'电影质感与细节连贯'上略胜一筹,Seedance 2.5则在'镜头运动与指令执行'上表现更佳。两者代表了AI视频的两种主流路径——闭源工业化与开源生态化。在机器人训练数据等严苛任务中,两款模型均未完全达标,AI视频从'能看'到'能用'仍有一段路要走。

MiniMaxH3视频模型开源多模态2K视频

相关推荐