- 博客
- ComfyUI 中 MiniMax H3 的负向提示词:真正有效的写法
AI Overview
MiniMax H3 在 ComfyUI 中是否支持传统负向提示?
官方发布的 H3 检查点为 CFG-distilled,因此标准流程图未采用常见的“正向—负向”条件配对。请先将精确的排除项写入主音视频提示(audiovisual prompt)中。
为何负向文本框看似存在却毫无作用?
某个自定义节点可能存储了负向文本,但未将其连接至实际生效的引导模块(guidance)。请沿条件输入(conditioning)、引导器(guider)与采样器(sampler)逐级追踪该字段;界面上可见的控件,并不意味着模型真正接收到了该输入。
如何移除不需要的文字、人物或摄像机运动?
首先清晰描述理想场景,再添加一至两条紧扣实际风险的“No…”句式。确保约束可被观测:例如“无字幕”“仅一人出镜”或“固定机位”。
何时应尝试社区提供的负向引导(negative-guidance)节点?
仅当干净的官方基准流程仍无法满足需求,且所用补丁明确兼容您的 H3 检查点、ComfyUI 版本及任务模式时,才考虑启用。请先保存当前可用的流程图,并每次仅变更一项进行对比测试。

该成品输出对应一项可量化的简报要求:单主体、单杯具、无标识与额外人物,且构图为固定机位。此为示意性生成图像,非官方 H3 基准测试结果。
为何负向提示框缺失?
图像扩散流程图通常通过独立分支分别传递正向与负向文本条件。MiniMax 将已发布的 H3 FL2VA 和 Ref2VA 检查点描述为 CFG-distilled 权重。因此,官方流程图仅使用主条件路径,而非常见的双分支结构。
这也解释了为何 H3 模板可能仅暴露一条文本通路,而社区节点虽显示负向字段,下游引导器却从未消费该输入。经补丁修改的流程图或许会自行添加排斥分支,但该行为属于补丁本身——并非 H3 的默认能力。
请以流程图本身为唯一可信来源。沿条件输入、引导器与采样器全程追踪该字段。若其最终仅作为元数据、预览文本或未连接的插槽存在,则无法影响渲染结果。请先依据 MiniMax H3 ComfyUI 配置指南 构建稳定可用的基础流程图,再着手调试排除项。
缺失的负向提示框并非安装异常。请撰写精确定义的场景契约(scene contract),强化正向描述的完整性,显式添加排除项,并将第三方补丁严格限定于受控实验场景。
将负向目标转化为正向场景契约
诸如“质量差、丑陋、模糊”等泛化负向描述,无法说明时间维度上“应当发生什么”。H3 协同调控身份、动作、摄像机、氛围、对白、特效与音乐,因此每项约束都应紧邻其所规范的具体事件。
按以下顺序构建提示:
- 锁定起始帧。 明确媒介类型、景别、人物数量、服饰、环境及初始动作。“一位陶艺家,腰部以上构图,双手可见,正在塑制一只陶碗”比“不要出现多余的手”更具可执行性。
- 编写时间线。 将每个物理动作与摄像机指令配对;对于多镜头片段,还需标注具体时间节点或剪辑点。清晰的时间线能大幅减少被自由发挥填补的空白运动。
- 单独指导音频。 明确说明空间声效(room tone)、对白、音效与配乐。若需静音或无配乐,请在音频指令中直接声明,而非寄望于视觉负向提示消除声音。
- 结尾附加小型排除块。 仅使用导出结果中可观测的约束。两条精准句式比复用的词元列表更易诊断与调试。
该方法遵循更广泛的 MiniMax H3 提示指南 所述制作逻辑,但聚焦于失效预防。核心在于将每一项担忧转化为一项接纳条件:“无人群”转为“仅一名可见表演者;中庭保持空旷”;“无抖动摄像机”转为“三脚架固定画面,禁止平移、俯仰、缩放、翻滚或重新构图”。

针对人物数量控制,请检查背景、镜面反射、出入口以及最终帧——而不仅关注中心表演者。
即用型排除模板
请将以下模板作为简短收尾使用,而非完整提示。替换其中名词,并仅保留最贴合您镜头最高代价失效风险的那一行。| 未能防止的问题 | 可直接复用的条款 | 需检查的位置 |
| --- | --- | --- |
| 虚构字幕或品牌标识 | 全程不得出现任何字幕、字幕条、界面元素、Logo、标签、文字或水印。 | 画面四角、反光表面、产品正面、末帧 |
| 多余人物 | 整个镜头中仅可见一人;无人进出画面、穿越画面、出现在镜面反射中,或在背景中凭空浮现。 | 门框、窗户、镜子、具有人群感的纹理区域 |
| 摄像机漂移 | 摄像机须固定于三脚架;禁止平移、俯仰、推拉、缩放、翻滚、抖动或自动重构图。 | 地平线、画幅边缘、主体尺寸随时间的变化 |
| 非预期音乐 | 仅允许自然环境底噪及指定音效;禁止非叙事性音乐、人声演唱、掌声或画外音。 | 开场节拍、转场段落、结尾音频尾音 |
| 道具重复 | 一只瓶子与两瓣柑橘须保持物理一致性;禁止出现重复产品、悬浮碎片或标签变更。 | 遮挡过程、飞溅峰值、显露瞬间、反射影像 |
| 手部形变 | 双手须始终符合解剖学结构(每只手五指完整),且持续接触同一容器。 | 接触关键帧、运动模糊区域、物体边界 |
避免逻辑矛盾。“手持式动感”与“无摄像机运动”不可并存。“繁忙工作台”与“无人出镜”亦相互冲突。请重写正向场景描述,使排除项具备合理性:例如服务结束后的空置平台、已关闭的拍摄现场,或背景为浅景深且无可读标识的画面。
对于原生音频,请将静音与声音约束置于对应字段。推荐采用如下实用结构:主集成场景描述 → overall_soundscape → non_diegetic_music。如需在选择提示词结构前比对所支持的生成模式,MiniMax H3 模型页面 是合适的起点。

产品简报应将物体数量、空白标签区、材质、液体行为及禁用标记分别列为独立的可视检查项。
构建无虚假控制的 ComfyUI 工作流
从一个已验证可用的 H3 模板入手,支持文本生成音视频、首尾帧生成,或参考图生成音视频。先运行短时基线测试,再添加便捷节点。保存工作流并记录版本;测试排除项期间,保持随机种子(seed)与持续时间(duration)不变。
使用以下连接审计表:
| 检查项 | 标准工作流 | 已打补丁的负向工作流 |
|---|---|---|
| 主文本输入 | 正确接入 H3 条件控制 | 正确接入正向条件控制 |
| 负向文本输入 | 以排除项形式写入主提示词 | 必须接入补丁文档中明确指定的负向分支 |
| 引导器(Guider) | 与标准模板一致 | 必须匹配该补丁所要求的引导器类型 |
| 采样器设置 | 保持基线参数值 | 首先仅调整补丁强度(patch strength) |
| 视频与音频解码 | 两者均被保留 | 确认补丁未丢弃音频条件控制 |
切勿仅因某控件标注“负向”就盲目提高 CFG 值。经蒸馏的标准路径未必遵循图像生成范式,而社区节点对 scale 的定义也可能不同。请先确认所用模型与连接方式是否受支持,再以一个适中数值与基线对比测试。
参考图可解决纯文字无法克服的失败问题。若模型持续虚构服饰、产品外形或身份特征,请切换至 参考图生成视频工作流,并提供干净参考图。更强的正向锚点往往比叠加更多禁令更能稳定抑制不期望变化。
请审查运动中的接触点与完整音轨。静态帧无法揭示时间维度上的漂移、幻影击打或非预期音乐。
当排除项仍失效时的诊断方法
负向字段完全无效。 绕过自定义节点,确认基础图谱可正常渲染。追踪该字段是否生成了当前激活引导器实际使用的条件控制信号。若未使用,则将排除项移回主提示词;若已使用,则核查 scale 设置与检查点(checkpoint)兼容性。
不期望的文字仍出现。 移除所有类文字参照,避免广告牌与包装元素,并明确指定“空白表面”。若不希望出现字幕,请直接声明。清理提示词比在充斥标识的场景中做“反向提示”更安全。
人物或道具重复出现。 在开头即明确定义数量,并描述主体的连续运动路径。重复使用名词可能被误读为新增实体,因此建议采用稳定指代,例如“同一位舞者”或“唯一瓶子”。若涉及已知角色,请清晰分配参考图,而非堆叠外观相似的图像。
接触时手部发生形变。 减少双手同时执行复杂动作的情况,确保关键接触区域在画面中占比足够大,并简化物体几何结构。排除语句的作用次于镜头设计本身。相比快速运动的全景镜头,中景或近景能为模型提供更充足的像素资源来准确建模手指结构。

设计镜头时,应使验收条件清晰可见:双手、单一道具、持续接触,以及足以判断解剖结构的足够画面比例。
画面正确但音频错误。 分别检查音频提示词与音频解码路径。明确说明预期的环境音、音效、对白及音乐状态。若问题表现为语音伪影(而非非预期音乐),请参阅 MiniMax H3 含糊语音故障排查指南。
运行验收测试并仅重跑失败项
先完整播放导出结果一次(不暂停),再带声音逐帧检查。对以下五项分别判定“通过”或“失败”:主体数量、禁用文字或标识、摄像机行为、物体与解剖结构连续性、音频合规性。记录首次出现失败现象的时间戳。此举可生成可复现的结果,而非仅凭模糊感受认为“负面提示未生效”。
采用升级式排查阶梯:
- 明确正向镜头描述,减少相互矛盾的细节;
- 增加一句可观测的排除性语句;
- 强化参考素材,或调整镜头景别(shot scale);
- 在保存的基线版本上,测试一个兼容的负向引导补丁(negative-guidance patch);
- 若单条提示承载事件过多,则缩短镜头时长或将其拆分。
在调整任一控制参数时,保持已批准的随机种子(seed)、参考素材、宽高比、时长及采样器(sampler)设置不变。若修复有效,请将带版本号的工作流及其输出一并保存;若引发音频丢失、运动僵硬或身份漂移(identity drift),则须立即回退,切勿通过新增多个调节滑块进行补偿。
动态产品测试可暴露标签变异、重复几何体、飞溅效果不连贯及意外音频——这些是静态海报无法呈现的问题。
Seedance Agent 可统筹镜头简报、保留参考素材分配、流转审核流程,并仅重新生成失败节拍(failed beat)。当维护已打补丁的本地图(patched local graph)所耗成本高于额外控制带来的收益时,建议启用该工具。
结论
MiniMax H3 在 ComfyUI 中实现可靠负向提示工作流的第一步,是接受这样一个事实:标准 CFG-distilled 路径并非传统意义上的“正向+负向”条件调控图。需明确定义目标画面与时间轴,为主音视频描述添加一至两条可量化排除项,逐一验证各节点连接,并将任何社区补丁与已存基线版本对比。以带时间戳的评分表全面评估完整音画片段,随后仅调整与失败直接关联的控制参数。若您希望在不自行管理图版本、参考路由、审批流程及局部重跑的前提下,仍获得同等严谨性,请使用 Seedance Agent 规划下一支受控视频。

RunningHub Seedance 2.0 API 配置:密钥、资源与首次调用
配置 RunningHub Seedance 2.0 API,选择 AI 应用或 ComfyUI 路径,映射资源,轮询任务,保存输出,并解决常见错误。
阅读文章
MiniMax H3 角色替换工作流:保留镜头
使用 MiniMax H3 Ref2VA 在视频中替换角色,同时保留动作、摄像机运动、环境及音频。复制提示词并修正身份漂移。
阅读文章
Magnific AI 视频超分设置:实用指南
为肖像、产品、AI 生成视频、运动画面、2K 或 4K 输出、FPS 提升、创意性与精度,选择 Magnific 视频超分设置。
阅读文章