参考生视频
从参考素材开始
用图片、视频和音频参考控制结果,同时保留一条完整的文字导演指令。
输出控制
渲染前设置模型、时长与画幅。
Hailuo 3 · Native 2K video with synchronized audio and multimodal reference control.
素材数量由所选模型决定,音频不能单独使用。
0/7000
4s5 秒15s
2K固定
水印
在导出视频上添加服务商水印。
需消耗积分:40
请先描述要生成的场景。
最近渲染
新任务会在渲染过程中实时更新。
MiniMax H3 参考生视频怎么用
参考生视频是 H3 区别于单输入模型的地方。它不把图片、视频片段和音频当成三个独立工具,而是连同你的文字描述一起读成一个整体上下文。这意味着你可以从照片里锁住角色的脸、从视频里借来运镜方式、让画面踩住音轨的节奏——在同一次生成里完成。
每种参考各自控制什么
- 1
图像参考:身份与风格
用来锁定一张脸、一套服装或一种视觉风格。正是这个参考让角色能跨多个镜头、多次生成保持不变。
- 2
视频参考:运动与镜头
给一段你想借用其运动方式的片子。H3 会沿用它的镜头行为和节奏,但不会复制里面的主体。
- 3
音频参考:节奏与时机
给模型一条音轨,它会把剪切点和动作对齐到音乐上。适合画面必须踩点的音乐向剪辑。
组合参考而不让模型混乱
参考之间相互矛盾时会打架。下面几条能让它们配合而不是冲突:
- 一个参考负责一件事。图像管身份、视频管运动、音频管时机——不要用两张图去争同一张脸。
- 让文字提示词当裁判。参考和提示词冲突时,提示词要写明以哪个为准。
- 图像参考要裁紧到你真正想保留的部分。参考图里的背景细节会渗进成片。
- 要跨镜头保持角色一致,每次生成复用同一张图像参考,而不是每次用文字重新描述这个角色。
一个完整示例
以一张裁紧的人像作为图像参考,这条提示词能在全新场景里保持角色一致:
参考中的角色穿过被雨打湿的夜市,侧面缓慢跟拍,霓虹招牌倒映在湿漉漉的路面上,面容与夹克与参考图一致,环境雨声与远处摊贩叫卖。
明确点名参考("参考中的角色""与参考图一致")告诉了 H3 哪些要沿用、哪些要重新生成。不这么写,模型就得自己猜参考里有多少是指令、多少只是灵感。
常见问题
- MiniMax H3 支持哪些参考类型?
- 图像、视频和音频。图像参考锁定身份与风格,视频参考引导运动与镜头行为,音频参考驱动时机与节奏。可以在同一次生成中组合使用。
- 怎么让多个视频里的角色保持一致?
- 每次生成都复用同一张图像参考,而不是每次用文字重新描述。裁紧、光线好的人像特写比整个场景效果更好。
- 可以同时用多个参考吗?
- 可以,但要给每个参考分配不同职责——图像管身份、视频管运动、音频管时机。两个参考争夺同一个属性会得到模糊的折中结果。