TryH3
登录

参考生视频

从参考素材开始

用图片、视频和音频参考控制结果,同时保留一条完整的文字导演指令。

输出控制

渲染前设置模型、时长与画幅。

2K

Hailuo 3 · Native 2K video with synchronized audio and multimodal reference control.

素材数量由所选模型决定,音频不能单独使用。

0/7000
4s5 15s
2K固定

水印

在导出视频上添加服务商水印。

需消耗积分:40

请先描述要生成的场景。

最近渲染

新任务会在渲染过程中实时更新。

登录后查看作品

登录后即可生成视频,并在此查看你的历史记录。

登录

MiniMax H3 参考生视频怎么用

参考生视频是 H3 区别于单输入模型的地方。它不把图片、视频片段和音频当成三个独立工具,而是连同你的文字描述一起读成一个整体上下文。这意味着你可以从照片里锁住角色的脸、从视频里借来运镜方式、让画面踩住音轨的节奏——在同一次生成里完成。

每种参考各自控制什么

  1. 1

    图像参考:身份与风格

    用来锁定一张脸、一套服装或一种视觉风格。正是这个参考让角色能跨多个镜头、多次生成保持不变。

  2. 2

    视频参考:运动与镜头

    给一段你想借用其运动方式的片子。H3 会沿用它的镜头行为和节奏,但不会复制里面的主体。

  3. 3

    音频参考:节奏与时机

    给模型一条音轨,它会把剪切点和动作对齐到音乐上。适合画面必须踩点的音乐向剪辑。

组合参考而不让模型混乱

参考之间相互矛盾时会打架。下面几条能让它们配合而不是冲突:

  • 一个参考负责一件事。图像管身份、视频管运动、音频管时机——不要用两张图去争同一张脸。
  • 让文字提示词当裁判。参考和提示词冲突时,提示词要写明以哪个为准。
  • 图像参考要裁紧到你真正想保留的部分。参考图里的背景细节会渗进成片。
  • 要跨镜头保持角色一致,每次生成复用同一张图像参考,而不是每次用文字重新描述这个角色。

一个完整示例

以一张裁紧的人像作为图像参考,这条提示词能在全新场景里保持角色一致:

参考中的角色穿过被雨打湿的夜市,侧面缓慢跟拍,霓虹招牌倒映在湿漉漉的路面上,面容与夹克与参考图一致,环境雨声与远处摊贩叫卖。

明确点名参考("参考中的角色""与参考图一致")告诉了 H3 哪些要沿用、哪些要重新生成。不这么写,模型就得自己猜参考里有多少是指令、多少只是灵感。

常见问题

MiniMax H3 支持哪些参考类型?
图像、视频和音频。图像参考锁定身份与风格,视频参考引导运动与镜头行为,音频参考驱动时机与节奏。可以在同一次生成中组合使用。
怎么让多个视频里的角色保持一致?
每次生成都复用同一张图像参考,而不是每次用文字重新描述。裁紧、光线好的人像特写比整个场景效果更好。
可以同时用多个参考吗?
可以,但要给每个参考分配不同职责——图像管身份、视频管运动、音频管时机。两个参考争夺同一个属性会得到模糊的折中结果。