MiniMax H3 Max 提示词指南:如何使用最快的 AI 视频模型
除了速度极快之外,我喜欢 MiniMax H3 Max 的另一个原因是,它比基础版 Minimax H3 模型提供了更出色的提示词执行力。考虑到大多数 AI 模型往往为了速度而牺牲性能,这一点就显得尤为难得了!话不多说,接下来就让我们向您展示如何使用 MiniMax H3 Max 正确的提示词,从而制作出高质量的视频!
TL;DR
根据我的经验, MiniMax H3 Max 在简洁的时间轴引导下表现最佳。首先设置视觉元素(风格、光线、纹理等),然后设置场景(主体、地点等),接着设置时间轴顺序(动作、镜头运动、对话等),然后设置声音(音乐、音效等),最后设置排除项。现在就可以在Pollo AI 上使用 MiniMax H3 Max 开始创作视频了!
MiniMax H3 Max 提示词指南:概览
在详细介绍如何在 MiniMax H3 Max 上编写提示之前,让我们花点时间来分析提示词中的每个关键要素以及它们为何如此重要:
| 方面 | 作用 | 输入内容 |
|---|---|---|
| 风格 | 确立视觉规则 | 媒介、质感、色调、光线、写实主义 [电影胶片、35 毫米胶片等] |
| 场景和主体 | 明确描述了正在发生的事情、在场人员等等。 | 角色、服装、环境、道具、互动 |
| 时间线 | 精确分配电影、动画短片、品牌广告等每一秒钟内事件的展开方式。 | 镜头节奏、动作、转场、结尾等。 |
| 镜头 | 控制视角和移动 | 构图、镜头手感、摇摄、跟踪、推拉、静态保持等。 |
| 声音 | 设定整个场景的声音氛围 | 对话、氛围、音乐、屏幕上的确切台词 |
| 排除项 | 避免可预见的偏移问题 | 不要额外人物、不要字幕、不要剪辑、不要虚构 Logo 等 |
使用 MiniMax H3 Max 编写提示词:您需要了解的内容
首先,我必须说, Fal.ai 在 MiniMax H3 Max 的开发上做得非常出色。与基础版 Minimax H3 相比,速度提升令人惊叹;原版简直就像静止不动一样!事实上,我还专门用 MiniMax H3 Max 与其他 AI 模型(例如 Seedance 2.5 和 Wan 3.0)进行了对比测试,测试它们在AI 视频制作方面的表现。
计划是生成一段 15 秒、768p 分辨率的故事视频。使用 Minimax H3,我花了 7 分 11 秒才输出; Seedance 2.5 则用了大约 5 分 49 秒;而 Wan 3.0 则用了大约 7 分 24 秒。当我尝试使用 MiniMax H3 Max 时,竟然只用了 30 秒就完成了!
但更令人印象深刻的是, Fal.ai 同时还提升了模型对提示词的遵循度。无需权衡取舍,这绝对是一次彻底的升级!当然,这也引出了关键问题:如何才能更好地构建提示?
使用 MiniMax H3 Max,我发现时间戳方法能最有效地获得准确的结果。你看,大多数 AI 提示词的一个常见错误是,它们写得像冗长的场景描述,缺乏结构。
以下是一个大多数人常做但会生成不良结果的例子:
提示词:【一架客机在城市上空失去控制,坠毁在地面,撞击力巨大。电影画面。震撼音效。】
看出问题了吗?这给 MiniMax H3 Max 留下了太多自由发挥的空间,例如飞机、乘客、镜头角度、音效等细节,都没有明确说明。AI 模型会在这些未定义的部分自行补充,因此更容易生成不可预测的结果。
但在使用 MiniMax H3 Max 后,我发现,当我按时间戳来组织提示词时,更容易得到想要的画面。换句话说,我建议你从头到尾明确标注视频每一秒应该发生什么。
考虑到 MiniMax H3 Max 的提示词遵循能力已有明显提升,这种方法能够进一步放大它的优势。你对镜头描述得越具体,MiniMax H3 Max 就越能忠实遵循你的指令。
那么,正确的写法是什么?下面是一段在 MiniMax H3 Max 上可能表现更好的提示词示例:
提示词:
风格:真人灾难剧,照片写实,暴风雨般的自然色调,真实的灯光。
场景:一架虚构的客机在傍晚时分遭遇强风暴,正接近一座沿海城市。雨水倾盆,乌云密布,地面湿滑,无任何品牌标识。
动作,15 秒:
0:00–0:03 机舱剧烈震动;灯光闪烁,乘客们屏住呼吸。
0:03–0:06 地面远摄镜头:飞机从云层中低空出现,不稳定且正在下降。
0:06–0:09 手持机舱镜头:飞机急剧倾斜;乘客倾斜,行李掉落,机组人员做好准备。
0:09–0:12 地面镜头摄,飞机消失在建筑物后面。
0:12–0:15 镜头对准天际线;远处的撞击产生延迟的烟柱,鸟群四散奔逃,汽车警报响起。
相机:逼真的手持拍摄效果,构图不完美,自动对焦自然,动态模糊;没有不可能的运动。
声音:湍流、引擎声、雨声、车厢嘎嘎作响、远处撞击声、回声、警报声。
音乐:克制的灾难配乐。
排除项:无对白、无尸体、无明显伤害画面、无血腥内容、无品牌元素、无夸张尖叫、无不真实物理效果。
输出视频:
明白我的意思了吗?第一个提示词示例留下了太多歧义, MiniMax H3 Max 无法正确解读。但这个电影视频提示词,我把场景分解成易于处理的片段,输出几乎完美地符合我的预期。
MiniMax H3 Max 提示词编写:详细分析
既然您已经了解了目标方向,接下来让我们详细分析一下构成完美的 MiniMax H3 Max 提示词的要素。请记住,这种格式同样适用于文本转视频和图像转视频的生成:
MiniMax H3 Max 提示词分解 #1:风格
提示词就是这样开始的,它应该放在最前面,因为它确立了场景的视觉规则。它通常由一些你肯定已经熟悉的方面组成:
- 媒介:真人拍摄、二维动画、三维 CG、水彩画等。
- 时代:当代、20 世纪 70 年代纪录片、复古未来主义等。
- 光线:柔和的窗光、强烈的正午阳光、高对比度的月光等。
- 纹理:细腻的颗粒感、手绘笔触感、干净的数码感、逼真感等等。
以下是一个正确风格设置的示例及其效果:
| 风格(示例) | 输出视频 |
|---|---|
| 实景体育摄影、电影级慢动作、4K 超高清画质、鲜艳色彩、明亮的体育场灯光、高帧率真实感 |
MiniMax H3 Max 提示词解析 #2:场景/提示词
描述场景内容和人物。这里,我鼓励你详细描述人物、地点、动作等等。如果人物需要在多个镜头中保持一致,那么请指出必须保留的特征,例如面部、发型、衣着等等。
这里有一个很棒的场景/提示词示例,以及它所产生的令人满意的结果:
场景/提示词(示例):
一位时尚女模型自信地穿梭在熙熙攘攘的纽约街角,从砖砌店面、涂鸦百叶窗、停放的车辆和川流不息的车流间穿梭而过。她身穿黑色露脐上衣、低腰宽松白色工装裤、高帮运动鞋,戴着银色太阳镜,脖子上挂着一副大耳机。她步伐轻松自在,节奏感十足,不时瞥向镜头,身后的行人和车辆来来往往。画面从明亮的午后街道过渡到昏暗的夜色街区,路灯和霓虹灯的微光交相辉映。
输出视频:
MiniMax H3 Max 提示词解析 #3:时间线/镜头运动
现在,这是最重要的部分。你如何构建这个场景将决定整个流程的运行方式,因为 MiniMax H3 Max 及其对提示词的严格遵循会逐拍渲染。但我喜欢它的另一个原因是,它能让你更容易地找到任何故障的根源。
如果 MiniMax H3 Max 出现问题,我可以精准定位问题所在,迅速进行修改和迭代。例如,以下是我制作的一段宣传视频的节选:
时间线(示例):
0:00–0:02 镜头透过狭窄的拉链开口窥视,露出蹲着的第一个人,然后迅速拉开,呈现出东京街景的低角度画面。
0:02–0:04 镜头快速摇摄,第二个男人走过,向镜头做手势;旋转模糊过渡继续。
0:04–0:06 镜头倒退着穿过明亮的抓娃娃机游戏厅,他向前走去,面带微笑,把一个粉红色的物体贴在耳朵上。
0:06–0:08 镜头切换到复古餐厅;低角度拍摄他伸手越过桌子递上食物,随后出现短暂的迷幻热成像闪光。
0:08–0:10 第一个男人拿着饮料出现;镜头向下扫过,然后切到外面,两人边走边击掌。
0:10–0:13 极低角度的鱼眼镜头向上看,它们高高地悬在镜头上方;其中一只伸向镜头,画面旋转成黑色。
输出视频:
想观看更多 MiniMax H3 Max 的视频示例?请查看我们的MiniMax H3 Max 评测。
MiniMax H3 Max 提示词解析 #4:音频/声音设计
对于原生音频生成,我建议您将对话和音效放在不同的模块中。声音部分应涵盖环境音、动作音效、非语言人声等。换句话说,将它们与时间轴部分分开。
但如果需要对话,就像任何电影脚本一样,我建议您在时间轴上安排好对话,并指定说话人。否则, MiniMax H3 Max 可能会遗漏重要的台词,或者无法将音频与正确的说话人同步。您可以在这里查看如何处理这种情况的示例:
时间线(对话示例):
(0–4 秒)决斗场地的广角镜头。肌肉发达的男子与年迈的功夫大师对峙。裁判举起手,开始倒计时,英语台词:“3……2……1……”。
(4–7 秒)裁判大喊“Go!”并发出开始信号。功夫大师微微鞠躬。
(7–9 秒)大师刚鞠躬时,肌肉男抬腿直接踢向他的头部。大师倒下。全场观众震惊地倒吸一口气,僵在原地。
(11–15 秒)肌肉男用英语说道:“我以为比赛已经开始了,这个老头为什么还在鞠躬?”
声音(示例):
人群低语和远处场馆环境音;裁判在倒计时时的声音清晰回响。踢击前有急促脚步声和衣物划动声,随后是沉重但不血腥的撞击声,以及大师倒地的声音。观众大声吸气,随后短暂安静。在最后一句对白前加入细微的喜剧停顿。
输出视频:
MiniMax H3 Max 提示词分解 #5:排除项
如果想减少反复生成的次数,我强烈建议在提示词中加入排除项。正如我多次提到的,MiniMax H3 Max 的提示词遵循能力较强;但如果不加限制,也会给画面偏移留下不必要的空间。
这里的关键并不是列出所有你不想看到的内容。根据我的经验,在 MiniMax H3 Max 中效果更好的做法是:优先排除那些会直接破坏镜头的错误,例如以下示例:
排除项(示例):
仅限两名牛仔。不得出现其他人物、马匹、动物、背景角色、重复角色、倒影或人群。不得出现角色位置互换、交叉、并排、违反 180 度规则、镜像屏幕方向、镜头轴线跳跃或不一致的地理环境。不得出现第二把左轮手镜头、步镜头、备用武器、重复镜头套、凭空出现的武器或左轮手镜头瞬移。不得接住或捡起被扔出的镜头。不得出现血腥、暴力、镜头击、镜头口火焰、爆炸、现代物品、现代服装、现代车辆。
输出视频:
好了!我已经为你提供了一份清晰的指南,教你如何构建完整的提示词,并用实例详细讲解了每个部分。如果你遵循这个格式,就能更容易地获得想要的结果。需要帮助时,随时可以参考这份指南!
为了获得更好的生成效果,请查看我们的MiniMax H3 Max 使用指南。

立即使用 MiniMax H3 Max:前往Pollo AI
现在您知道如何使用 MiniMax H3 Max 提示词了吧?那么,您应该去哪里开始用它生成视频呢?我建议您去 Pollo AI。我几乎每天都会使用这个平台,因为它是面向营销人员和内容创作者的终极 AI 创意套件。

在这里,我拥有您所需的一切,只需几分钟即可将您的想法转化为可发布的视频。它集成了Seedance 2.5、Wan 3.0 等领先的 AI 模型,我可以无缝切换,轻松制作出完美的电影短片、动画、音乐视频等等。
更棒的是,我特别喜欢用Pollo 智能体,因为它能自动化制作流程。我只需要描述我的想法,它就能处理故事板、视觉效果、节奏等等,让我可以制作营销视频、电商视频、社交媒体内容等等;无需手动剪辑!
如果我想让机器人更专注于制作推广视频,我会使用 Pollo AI 的 Marketing Studio。我经常用它来创建独特的品牌内容,例如对比 UGC 生成内容广告、客户评价视频、推广视频等等。访问 Pollo AI 网站,你就会明白它为何如此受欢迎!
关于 MiniMax H3 Max 提示的常见问题
MiniMax H3 Max 提示词应该有多长?
我认为这取决于场景的复杂程度。关键在于遵循时间戳格式,并确保每个方面都清晰详细地涵盖在内。明确视觉风格、场景、时间线、摄像机、音频和排除项,但要避免用不必要的填充内容使简报过长。
在 MiniMax H3 Max 提示词中,什么应该放在前面?
始终先确定风格以设定构图,然后确定场景/提示词以定义人物、事件和地点,然后可以着手建立时间线和摄像机指令,最后添加音频,并排除任何你不想看到的内容。
为什么时间戳在 MiniMax H3 Max 提示词中很重要?
他们会将你的视频分割成不同的片段。这样,模型就能在最终场景的恰当时机渲染出每一个动作、人物,甚至是每一句对话。否则,某些部分可能会被遗漏,或者不必要地片段。
MiniMax H3 Max 可以使用参考图像、视频或音频吗?
使用 MiniMax H3 Max,您只能使用文本转视频或图像转视频功能,并需要指定起始帧和结束帧。但如果您需要更广泛的多模态支持,则可以切换到基础款 Minimax H3 模型,该模型支持图像、音频和视频的指定帧。
使用 MiniMax H3 Max 时是否应该包含否定提示?
当然。通过添加否定提示/排除项,可以确保视频不会受到不必要的画面元素、物体、文字、镜头移动、风格变化等的影响。但要注意重点,不要罗列所有内容。重点关注你最想避免的高优先级缺陷。
MiniMax H3 Max 提示词出现问题,如何改进?
使用时间线提示的好处在于,如果结果不理想,就能轻松找出问题所在。即使无法精确定位,也可以逐个类别进行修正,直到解决问题。幸运的是, MiniMax H3 Max 的速度非常快,因此迭代过程十分轻松。



