MiniMax H3 提示词
MiniMax 的多模态视频模型——从文字、图片、视频片段或音轨出发,生成自带原生立体声的视频。
关于 MiniMax H3
MiniMax H3 是 MiniMax 海螺视频系列的旗舰,最大的特点是输入端真正多模态、输出端一步到位。你可以从一段文字描述、一张参考图、一段已有视频、一条音轨或它们的组合开始生成——而结果自带与画面同步生成的原生立体声,不是事后配上去的。
这个组合让它成为「成片感」需求的首选:靠环境声带货的广告片、靠脚步声和空间音撑住情绪的叙事镜头、需要让静态照片带着可信的运动和声音活起来的图生视频。它继承了海螺系列著称的物理真实感,对推轨、环绕、手持等镜头指令的服从度也格外高。
用过海螺 02 的人会觉得 H3 很熟悉,但它对「含糊」远没那么宽容。老一代给一句场景描述就能替你把剩下的补齐;H3 摆出六七个彼此独立的控制杆——主体、动作、场景、镜头、光线、声音,以及输入模态本身——你不拉的那根,它就按自己的默认值还给你。控制力更强这件事,只有你真的花掉它才算优势。
由此带来的实际差别是:一条 MiniMax H3 提示词更像分镜表,而不是图注。写「雨中行走的女人,电影感」,你会拿到一条合格但没有面孔的片子;写清镜头焦段、她行走的方向、摄影机相对她的运动、光的质感、雨落在什么材质上是什么声音——你拿到的才是一条真能剪进片子里的镜头。
正因为 H3 接受这么多种输入,提示词就是告诉它「这次做哪种活」的唯一途径——写得含糊,恰恰浪费了它最强的可控性。上方画廊收录了经过验证的 MiniMax H3 提示词及真实生成视频,直接复制一个已跑通的结构,换上你自己的主体、运动和声景即可。
本页所有提示词都可以免费复制:不用注册、没有付费墙、提示词正文没有水印。拿走结构,换掉名词,在你能用到模型的地方跑就行。
如何写好 MiniMax H3 提示词
- 1按「主体 → 动作 → 场景 → 镜头 → 光线氛围 → 声音」的结构写。H3 六层都读;漏写哪层,哪层就由模型替你决定。
- 2把它当镜头写,不要当图注写。「电影感」「高质量」是最不值钱的两个词——换成你真正想要的那件具体的事:焦段、调色、时辰、天气。
- 3用真实的镜头语言:「缓慢推轨」「手持跟拍」「绕主体环绕」。H3 对有名字的镜头运动的执行精度,远高于「动感镜头」这类空泛说法。
- 4要慢动作,就把它写成画面的属性、而不是人物的属性:「以慢动作拍摄,水珠悬停在空中」有效;「她走得很慢」只会让她以正常速度慢吞吞地走。想在片中变速,就写清变在哪一刻——「实时速度,玻璃落地瞬间转入慢动作」。
- 5把声音明确写出来——声音是原生生成的,它真的听:「铁皮屋顶的雨声、远处闷雷、不要配乐」或「明快合成器配乐在旁白下渐强」。不写声音,得到的就是泛泛的环境音。
- 6写材质,不要只写声音。「脚步声」太泛;「靴子踩在湿砾石上」才给了模型可以合成的材料。从「雨声」到「引擎声」,这个办法一律有效。
- 7如果你要的是没有声音,那就明说——「无配乐、无对白,只保留室内环境音」。安静也是一条 H3 会照办的指令,前提是你下了这条指令。
- 8从参考图出发时,只描述运动和镜头——图片已经定了主体、风格和构图,再复述一遍反而会引入漂移。
- 9每次生成只给一个连续的动作节拍。一条片子想塞三个故事时刻,三个都会糊掉;故事更长就分段生成再剪。
- 10把你的画面基调冻结成一条可复用的子句——胶片质感、调色风格、镜头特性——整个 campaign 保持一字不改,成片才能剪到一起。
- 11要跨镜头保住同一个人物,就把同一张参考图喂进每一次生成,而不是反复用文字描述这个人。文字描述的脸会在多次生成之间漂移,图片不会。
- 12结果没打中时,只改一层再生成,别整条重写。整条重写你就再也说不清到底是哪一句起的作用。
常见问题
MiniMax H3 的提示词该怎么写?
按分镜表的顺序写:主体、动作、场景、镜头运动、光线氛围、声音。H3 把这几层各自当成一条独立指令,你留白的那一层,它就用自己的默认值填。每次生成只放一个连续动作,镜头运动用真实的摄影术语,声音一定要点名。上方画廊里的每一条提示词都是这个形状——最快的学法就是复制一条,把主体换成你自己的。
MiniMax H3 是免费的吗?
本页的提示词是免费的:无需账号、没有付费墙,随便复制。模型本身要通过 MiniMax 的海螺 AI 或 MiniMax 开放平台 API 使用,具体的套餐和免费额度由 MiniMax 那边定,当下怎么算请以他们的页面为准。
MiniMax H3 最擅长什么?
需要「拿到即成片」的片段:画面与立体声一次生成,输入端不挑食——文字、静态图、已有片段、音轨都行。物理真实感和精准的镜头服从度,让它在广告、电影感长镜头和图生视频场景里格外强。
MiniMax H3 会生成声音吗?
会——立体声与画面原生同步生成,不是后期配音。要发挥它,就在提示词里直接导演混音:写清环境声、音效、要不要配乐。什么都不写,得到的就是泛泛的环境音。
怎么让 MiniMax H3 生成慢动作?
把慢动作描述成画面的属性,不是人物的属性。「以慢动作拍摄」或「高速摄影机拍摄、慢速回放」改变的是这条片子怎么被拍下来;「她动作很慢」只会让主体在正常速度里显得迟钝。再配一个只有慢下来才看得见的细节——水花、尘土、布料、发丝——让效果有东西可展示;想中途变速,就点名变在哪一刻。
可以不用文字,从图片或音轨开始吗?
可以。H3 输入端是多模态的:参考图可以定主体和构图,已有片段可以延展或改风格,音轨可以驱动整个场景。当图片已经承载了画面风格时,文字提示词只管运动和镜头就好。
MiniMax H3 和海螺 02 有什么区别?
它们是同一条海螺视频线的两代。海螺 02 给一句场景描述,剩下的决定大多替你做了;H3 输入端多模态、立体声与画面原生同生,并且把更多决定权当成可控项交还给你——这意味着它奖励写得细的提示词,也比老一代更不容忍偷懒的提示词。
为什么 MiniMax H3 漏掉了我提示词里的一部分?
通常是因为一条提示词同时要了好几件事。H3 处理单个连续动作节拍很稳,一条覆盖三个故事时刻的提示词会被平均成一团糊。另一个常见原因是把参考图已经定死的东西又用文字描述了一遍——图说一套、文字说另一套,结果就漂。把提示词砍到一个动作节拍,一次只改一层,再生成。
在哪里可以试用这些 MiniMax H3 提示词?
H3 可在 MiniMax 的海螺 AI 中使用,开发者可走 MiniMax 开放平台 API。从本页复制任意提示词粘贴过去,换成你自己的主体、镜头运动或声景即可。
相关模型
Hailuo 02
MiniMax's Hailuo video model with standout physical realism.
Speech 2.5
MiniMax's multilingual voice synthesis model.
Seedance 2.0
ByteDance's #1-ranked video model — multi-shot direction with native lip-sync and spatial audio.
Seedance 2.5
Seedance 2.5 is a next-gen AI video model that generates continuous, synchronized 30-second 4K clips from a single prompt.