快速回答
一条实用的 MiniMax H3 提示词,通常要交代六件事:主体、动作、环境、镜头、光线或视觉风格,以及必须保持的限制。动作要按发生顺序写。如果视频必须从某张图开始,或停在指定尾图,应使用首尾帧模式,并描述两帧之间如何变化。需要图片、视频或音频控制角色、动作、运镜或声音时,应使用参考素材模式,并给每份文件分配明确用途。
第一次只写一个主要动作和一种运镜。生成后从头到尾看完,再只改一个变量。不要把 negative prompt、seed 或镜头术语当作必然生效的硬指令。提示词是方向,不是结果保证。
最后核验:2026 年 8 月 4 日。minimaxh3.tv 是独立服务,与 MiniMax 不存在官方隶属、授权、运营或背书关系。

一条实用提示词会依次说明主体与动作、场景、镜头、视觉处理和限制。
MiniMax H3 提示词公式
可以先套用这个结构:
主体 + 动作 + 环境 + 镜头 + 光线/风格 + 限制
| 部分 | 写什么 | 示例 |
|---|---|---|
| 主体 | 主要人物、动物、物体或场景中心 | 一只红色纸船 |
| 动作 | 按顺序说明发生了什么变化 | 向前漂、被水流带动、转向石桥 |
| 环境 | 地点、天气、背景活动和重要物体 | 雨后的城市浅水渠 |
| 镜头 | 景别、方向、移动方式和速度 | 低机位跟拍,缓慢推进 |
| 光线或风格 | 可见的画面处理,不用空泛质量词 | 阴天自然光,克制的纪录片色调 |
| 限制 | 需要保持不变或应避免的状态 | 纸船始终为红色,保持完整 |
MiniMax 官方 H3 提示词写作指南还给出了更完整的时间线结构,把内容分为 integrated_multimodal_description、overall_soundscape 和 non_diegetic_music。需要分镜、对白、环境声或配乐时,可以使用这种结构。普通网页生成只有一个短镜头时,不必强行写满三个字段。
文生视频提示词模板
文生视频没有起始图,提示词要负责建立完整镜头。
[视觉风格和景别]。[主体]位于[环境]。
先发生[动作 1],接着发生[动作 2]。镜头以[速度]进行[一种运镜]。
[光线和可见氛围]。最后停在[明确结束状态]。
保持[角色、物体、颜色或构图限制]不变。
示例:
真人微距电影风。一只红色纸船漂在雨后的城市浅水渠里。纸船向前漂,被水流带动,然后转向一座石桥。镜头贴近水面,缓慢跟随纸船。阴天自然光,克制色调,水面有细小涟漪和湿润倒影。最后让纸船进入桥下阴影。保持纸船为红色且完整。
图生视频动作模板
在首尾帧图生视频中,图片已经给出主体、布局、颜色和开场构图。提示词应把篇幅留给动作和保持项。
使用上传的起始图作为开场构图。
[主体或物体]先做[第一个小动作],再连续完成[主要动作]。
镜头进行[一种运镜],同时[背景或光线变化]。
保持[身份、服装、形状、布局或产品细节]不变。
如果提供尾图,结尾自然到达尾图中的姿态和构图。
不要把图片里已经能看见的细节全部重写一遍。首图和尾图同时存在时,官方指南建议重点描述两帧之间的连续变化。
参考素材工作流模板
参考模式可以按顺序加入图片、视频和音频。不要只写“参考全部素材”,应明确每份素材负责什么。
图片 1 只负责主体身份和服装。
视频 2 只负责镜头路径和动作节奏。
音频 3 只负责节拍和时间点。
把主体放在[环境]中,让主体按顺序完成[动作]。
镜头从[开场状态]跟随到[结束状态]。
保持[身份和物体限制]。不要复制参考素材中无关的细节。

文字模式从描述建立镜头;首尾帧模式描述固定画面之间的路径;参考模式给每份素材分配用途。
十组可核验提示词示例
下面十组示例都有公开来源。只有高山湖面示例是 minimaxh3.tv 已核验的提示词与结果配对,其余九组根据 MiniMax 当前官方文档改写。它们可以当作起点,但不代表在本站必然得到相同结果。
| # | 模式与提示词 | 主要用途 | 证据 |
|---|---|---|---|
| 1 | 文生视频:A cinematic sunrise over a calm alpine lake, soft mist drifting above the water, slow camera push forward. |
主体、氛围、可见动作和一种运镜 | 下方本站已核验结果 |
| 2 | 文生视频:太空歌剧风格。舰长透过观察窗看着最后一支舰队跃迁离开,舰桥随之震动。镜头缓慢推向她在玻璃上的倒影,最后停在空旷星空。 |
事件顺序和结尾状态 | 根据官方 V2 API 示例改写 |
| 3 | 首帧:保持上传图片中的舞者和排练室。她先完成一个现代舞转身,再横穿地面,最后稳定收势。镜头缓慢横向跟拍。 |
不重复起始图,只描述动画过程 | 根据官方视频指南改写 |
| 4 | 首尾帧:从首图中的儿童姿态开始,通过姿势、服装和光线连续表现时间变化,最后到达尾图中的成年姿态。 |
描述两张锚点之间的变化路径 | 根据官方视频指南改写 |
| 5 | 参考素材:图片 1 负责模特面部和贝雷帽。保留阴天的石板巷。她向前走并调整帽子,镜头向后跟拍。 |
明确参考素材用途 | 根据官方参考生成示例改写 |
| 6 | 文生视频加声音:日出前,面包师打开木质百叶窗,把热面包放上柜台。镜头缓慢推进。加入街道底噪、托盘碰撞和一次门铃声,配稀疏木吉他。 |
画面时间线、环境声和配乐 | 根据官方提示词指南改写 |
| 7 | 首帧加对白:保持女子、列车座位、折叠信件和雨窗不变。镜头缓慢向右平移,她抬头看向城市灯光,说出一句短对白。 |
身份保持和单次说话节点 | 根据官方提示词指南改写 |
| 8 | 首尾帧:骑车人松开车把,举起收拢的雨伞,将它撑开,最后停在尾图的准确姿态。整个镜头只做一次缓慢拉远。 |
写清中间动作 | 根据官方提示词指南改写 |
| 9 | 尾帧:开场是一只完整玻璃杯放在桌边。一只手把它碰落,镜头跟随下坠和撞击,最后让碎片停在所给尾图的构图中。 |
从前置状态收束到固定结尾 | 根据官方提示词指南改写 |
| 10 | 文生视频:跑者从隧道进入日光。先用静态广角镜头等她到达出口,再只向右摇镜一次,露出开放跑道。 |
运镜变化只用于揭示新信息 | 根据官方运镜说明改写 |
示例 1 对应本站已有的公开结果:
还可以在 MiniMax H3 案例展示查看其他已核验片段。研究提示词效果时,只使用同时公开提示词和结果的案例。
运镜与动作词汇
官方指南用类型、幅度和速度描述运镜。只有幅度或速度会明显改变镜头时,才需要写出来。
| 术语 | 镜头怎样移动 | 自然提示词写法 |
|---|---|---|
| Push in / pull out | 摄像机实体向主体靠近或远离 | 镜头缓慢推向她手中的信 |
| Zoom in / zoom out | 摄像机不动,只改变焦距 | 镜头拉远,露出整个房间 |
| Pan left / right | 在原位置水平摇镜 | 镜头向右摇,露出门口 |
| Truck left / right | 摄像机水平侧移 | 镜头在骑车人旁边向左平移 |
| Tilt up / down | 在原位置垂直摇镜 | 镜头从鞋子向上摇到面部 |
| Arc shot | 围绕主体走弧线 | 镜头绕雕塑移动半圈 |
| Tracking shot | 跟随移动主体 | 低机位跟拍纸船 |
| Static shot | 镜头位置和焦距不动 | 跑者离开画面时保持静态广角 |
| POV | 使用主体视角 | 从副驾驶座位看到的主观镜头 |
不要把运镜词当标签堆在句尾。把镜头动作和一个具体动作或画面揭示绑在一起。短片里只用一种有效运镜,通常比同时塞四种更容易判断结果。
常见问题与单变量修复
| 现象 | 常见原因 | 只改一项 | 依据或测试状态 |
|---|---|---|---|
| 画面几乎不动 | 只写外观,没有写随时间发生的变化 | 增加一个有起点和终点的可见动作 | 官方时间线说明和已核验湖面示例 |
| 主体身份变化 | 新增外貌细节与图片或参考素材冲突 | 删除新增外貌,只写必须保持的部分 | 官方关键帧和参考素材说明 |
| 运镜显得随机 | 一个短镜头里塞了多种移动 | 保留一种与画面揭示相关的运镜 | 官方运镜说明 |
| 结尾突然中断 | 有动作,但没有结束状态 | 增加一个明确姿态、位置或构图 | 实用修改建议,不是成功率结论 |
| 首尾帧之间跳变 | 只重复描述两张静态图,没有中间路径 | 写清两帧之间逐步发生的变化 | 官方首尾帧说明 |
| 参考素材互相混合 | 每份文件没有明确职责 | 点名每个编号素材及其用途 | 官方参考素材工作流 |
| 对白被改写 | 对白混在很长的场景描述里 | 把原句单独放入简短说话指令 | 官方对白说明 |
| 否定要求没有效果 | 自然语言否定不一定是硬控制 | 改写成期望的正向状态,并删除一个冲突 | 待生成验证,不承诺 negative prompt 必然生效 |
提示词检查清单
- 只保留一个主要主体和一个主要动作。
- 按时间顺序写动作。
- 环境只写会影响镜头的部分。
- 第一次只用一种主要运镜。
- 描述可见光线或风格,不写空泛的“高质量”。
- 需要时明确保持身份、颜色、布局或产品细节。
- 给每份参考素材分配用途。
- 写一个清楚的结束状态。
- 检查全文是否存在互相冲突的要求。
- 看到结果后,一次只改一个变量。
常见问题
MiniMax H3 提示词应该写多长?
只要足够说清镜头即可。简单镜头通常三四句就够。需要分镜、对白或多种参考素材时,应增加结构。官方 API 最多接受 7,000 字符,minimaxh3.tv 当前提示框的上限更小。实际使用时以当前界面显示为准。
MiniMax H3 支持 negative prompt 吗?
本站当前公开界面把自然语言限制写在主提示词里。不要假设存在独立 negative prompt 字段,也不要承诺否定词必然生效。更稳妥的做法是描述期望的正向状态,并删除冲突要求。
可以指定 seed 吗?
minimaxh3.tv 当前生成器没有公开 seed 控件。界面不提供的参数,不能用来承诺结果可复现。
运镜词必须写在方括号里吗?
MiniMax 文档出现过 pan、zoom 和 static 等运镜指令,官方 H3 提示词指南也使用自然语言描述镜头运动。应采用当前界面能接受的写法,不要把某个术语理解为精确物理控制。
图生视频提示词重点写什么?
重点写动作、镜头路径、结束状态和必须保持不变的细节。起始图已经提供了开场构图。
怎样避免参考素材混在一起?
给文件编号,并分配用途。例如,一张图片负责身份,一个视频负责动作,一个音频负责时间点。与目标镜头无关的参考素材应删除。
长提示词可以直接照抄吗?
可以复制结构,但要替换主体、动作、环境和限制。依赖特定图片或参考素材的提示词,脱离原始输入后不一定成立。
来源与方法
本文于 2026 年 8 月 4 日核对了官方 MiniMax 视频生成指南、创建视频生成任务 API 文档、官方 MiniMax H3 视频提示词写作指南、本站公开的 MiniMax H3 文生视频生成器、案例展示,以及一组本站已有的公开提示词与结果。本文没有新建付费视频生成,也没有使用外部视频或社区评价。
准备测试提示词时,可以打开 MiniMax H3 文生视频。需要完整网页操作流程,可阅读 MiniMax H3 使用教程。



