Image 1
= face
Image 2
= product
Video 1
= camera
Audio 1
= voice
标明每条参考
给每个文件打上角色标签。H3 会融合图/视频/音频——含糊标签只会浪费次数。
Hailuo 03 是 MiniMax 新一代多模态视频模型:把提示词与参考素材变成原生 2K 有声成片。混合图像、视频与音频,跨镜头锁定角色与风格,再用自然语言精修——尽在 Hailuo3 AI。
浏览用 Hailuo 03 做出的多模态作品,带上你的参考素材,开始下一次生成。
顶尖画质、灵活参考、更长多镜头、角色锁定、对话式精修与完整音画同步——一个模型跑通完整创作链路。
三步从想法到导出

打开工作区,将视频模型选为 Hailuo 03(MiniMax H3)。

描述场景、运镜与声音,再添加图像、视频或音频参考,控制更稳。

设定时长与画幅,开启声音审片,需要时用自然语言微调,再下载。




点生成前先设好这三件事
Image 1
= face
Image 2
= product
Video 1
= camera
Audio 1
= voice
给每个文件打上角色标签。H3 会融合图/视频/音频——含糊标签只会浪费次数。
音频必须搭配图片或视频,不能单独使用。
别超官方上限。音频不能单独用——必须搭配图片或视频。
画幅
选 4–15 秒。文生视频要定画幅;图生视频跟输入帧;参考模式可用自适应。
为什么在 Hailuo3 AI 创作
多镜头广告自带原生音频,返工循环短了。Hailuo 03 终于够交付。
多模态参考真的能锁住——从全景到特写,面容与风格都在。
原生 2K 无需再放大,商详和投流都扛得住。
精准对话式修改省掉重生成。改外套,保留已满意的镜头。
24FPS 直接进时间线。客户审片轻松很多。
对白和音效一次生成,原型和可交付之间的差距就在这儿。
多镜头广告自带原生音频,返工循环短了。Hailuo 03 终于够交付。
多模态参考真的能锁住——从全景到特写,面容与风格都在。
原生 2K 无需再放大,商详和投流都扛得住。
精准对话式修改省掉重生成。改外套,保留已满意的镜头。
24FPS 直接进时间线。客户审片轻松很多。
对白和音效一次生成,原型和可交付之间的差距就在这儿。
多镜头广告自带原生音频,返工循环短了。Hailuo 03 终于够交付。
多模态参考真的能锁住——从全景到特写,面容与风格都在。
原生 2K 无需再放大,商详和投流都扛得住。
精准对话式修改省掉重生成。改外套,保留已满意的镜头。
24FPS 直接进时间线。客户审片轻松很多。
对白和音效一次生成,原型和可交付之间的差距就在这儿。
Hailuo 03 / MiniMax H3 问答
Hailuo 03(也称 MiniMax H3 或 Hailuo 3.0)是 MiniMax 旗舰多模态视频模型。在 Hailuo3 AI 上可获得原生 2K@24FPS、5–15 秒片段、文/图生视频、多模态参考、多镜头叙事、指令编辑与同步音频。
会。对白、音效与氛围与视频同一次生成,并与画面动作对齐。
原生 2K、24FPS。可选 21:9、16:9、4:3、1:1、3:4、9:16,或自适应让模型按提示词选构图。
纯文本提示、关键帧图像,或多模态参考。单次最多 9 张图、3 段视频、3 段音频,用于风格、角色、动作或声线引导。
Hailuo 2.3 大约 10 秒、1080p,主要靠文本或单图。Hailuo 03 升到原生 2K、最长 15 秒,并增加多模态参考、指令编辑、多镜头与同步音频。
可以。Hailuo 03 支持精准指令编辑——用一句话描述修改,即可在已生成成片上调整角色、物体、场景、声音或节奏。
MiniMax H3(Hailuo 03)积分套餐,一眼看清每档大约能出多少条 5 秒 / 10 秒视频。
积分按计费周期重置。视频估算按 MiniMax H3 5 秒 / 10 秒 · 2K 计算。
开始体验 AI 视频创作的魔力。
更深控制,规模化创作。
全速创作,流程不中断。
想象无界,成就 Wonder。