- 博客
- MiniMax H3 微表情提示词:直接触发细腻、自然的情绪表达
AI Overview
如何编写一个 MiniMax H3 微表情提示词?
明确指出情绪类型、可见的面部表现、触发原因,以及情绪稳定下来的瞬间。仅使用一种克制的变化——例如眼神柔和、下颌放松——而非堆砌大量戏剧化的情绪形容词。
为什么 H3 角色看起来空白或机械?
提示词可能仅描述了内在感受而未指定可观测的动作,或要求过多相互冲突的表演节拍。请为面部赋予明确诱因、单一可识别的反应、符合自然规律的眨眼与呼吸,并明确定义中性静止状态。
MiniMax H3 能否从参考素材中复制表情?
参考模式可利用图像或视频传递身份与表演信号。需为每个文件明确指定唯一角色,将面部身份信息与表演参考分离,并确保表情迁移不会覆盖角色原有特征。
对话内容与面部反应是否应一并提示?
是的,当反应与某句台词或停顿强关联时。可将表情置于台词前、台词中或台词后;保持口型运动与语音内容一致;避免镜头运动方向与面部反应同时发生冲突。
微表情提示词实际控制什么
微表情提示词应引导一个观众能在时间进程中清晰观察到的细微变化。“她感到紧张”属于表演指导,但并未告知模型由何种视觉信号承载该情绪。“她内侧眉毛轻微上扬,双唇短暂紧闭,随后呼气并放松下颌”则提供了一组可观测动作序列。后者更易于分镜、复核与迭代。
MiniMax H3 支持文本、图像、视频及音频上下文输入,其官方资料说明输出时长为 4 至 15 秒、帧率为 24 fps。这一时长足以呈现一次面部情绪的浮现、峰值与平复过程,但不足以支撑复杂情绪弧线叠加多次镜头调度。请将提示词视为紧凑的单镜拍摄简报:含角色、触发事件、可见反应、镜头、声音与收尾状态。

真正有效的目标并非“悲伤的脸”,而是一种可读的组合:湿润的眼眸、开始放松的下颌、受控的双唇,以及仍保持警觉的目光。
此处“微表情”是创意指导术语,而非临床情绪识别。请借助细微可见线索传达剧本设定的情绪,同时保留角色身份、解剖结构与口型同步精度。
将表情构建为有节奏的表演节拍
以中性基线起始。若无此基准,模型可能直接从最高强度开始,失去动态演进空间。其次,明确触发事件:列车驶离、名字被念出、消息结束,或另一角色暂停发言。接着选择两至三个协调一致的面部信号。最后描述新的静止状态。由此构成四段式节拍,可直接复用于绝大多数 H3 提示词:
- 基线: 面部沉着,目光平稳,肩部放松。
- 触发: 短暂停顿后,她听到画外音回应。
- 反应: 眼神柔和,下眼睑微微上提,嘴角一侧几近上扬。
- 平复: 她轻声呼气,回归专业镇定,目光中仍留有一丝关切。
避免为每处面部特征单独下达指令。眉毛、眼睛、鼻子、下颌、嘴唇与笑容等多重指令常彼此矛盾。优先聚焦单一过渡,并让呼吸、体态与视线自然辅助该变化。自然眨眼宜作为偶发标点,而非机械定时。

表现克制的紧张感时,请审视眉部、唇部压力、握力与体态之间的关系。面部不应突变为夸张的戏剧性恐惧。
镜头距离决定观众能否有效识别微表情线索。眼部、嘴角及下颌变化需使用特写或中近景呈现。若需广角建立镜头,请在情绪峰值前推进至面部,或另设独立镜头。MiniMax H3 远距离人脸处理指南 覆盖了人脸过小、难以稳定承载表演效果的情形。
四种可直接复用的微表情提示词模板
以下模板为全新编写的生产级模式,并非官方 H3 输出声明。请替换方括号中的剧情细节,同时保留可观测的动作序列。每种模板均聚焦一个主导性表演节拍。
隐匿的紧张: “[角色] 在 [地点] 外等候的中近景。面部初始沉着。听到 [触发事件] 后,内侧眉毛轻微上扬,双唇于一秒内短暂紧闭。一次浅呼吸使胸廓微升;手指在 [物体] 上逐渐松开。表情最终归于刻意维持的平静。眨眼节奏自然,无抽搐,无夸张恐惧。镜头保持静止。”
夹杂忧虑的释然: “[角色] 阅读 [结果] 的特写。双眼率先明亮,肩部放松,嘴角几近浮现微笑。随后目光转向 [画外对象],下眼睑仍残留一丝忧虑。一次轻柔呼气。最终定格于受控的专业镇定,而非欢庆姿态。”

*实用提示词需明确味觉触发事件与短暂反应——如眯眼、鼻部微紧、双唇受控——再回归问题解决状态。*私密的失望: “[角色] 品尝或检查 [物体] 时的特写镜头。短暂一瞬,鼻翼微蹙、双眼微眯,双唇仍紧闭;角色随即察觉自身反应,经鼻缓缓呼吸,继而目光坚定地重新投入手头任务。不呈现厌恶表情,不摇头,不喜剧化。”
对话中的倾听反应: “[说话人] 在画外说出最后一句台词时,以过肩近景拍摄 [倾听者]。倾听者保持眼神接触,在关键词落音后轻眨一次眼,嘴角一侧微微上扬,而双眼仍流露悲伤。停顿半拍后再作回应。呼吸与头部动作需克制自然;确保回应台词时口型同步。”
请勿将全部四条提示一次性提交。请选择目标情绪,适配触发条件,并删去无关描述。若片段含对白,请按播放顺序写出台词及对应反应。关于保持声音一致性的页面提供了一种实用复核方法,可用于跨镜头匹配语音与视觉表演,即使所用生成模型不同亦可适用。
选择模式与参考角色
文本生成视频(Text-to-video)要求 H3 全新构建人物、场景与表演,因此仅需描述足以维持角色可识别性的外貌特征即可。首帧图像生成视频(Image-to-video)已锁定开场人物面部与构图,应将提示词空间优先用于运动、表情节奏、视线方向,以及必须保持不变的要素。首尾帧模式适用于最终情绪必须精准落在特定画面的情形,但过渡过程仍需具备合理触发机制与克制的表现路径。
参考生成视频(Reference-to-video)适用于信号源自多个独立素材的场景。请明确分配角色:Picture 1 负责面部身份,Picture 2 负责服饰,Video 1 提供克制的倾听表演,Audio 1 提供嗓音音色。须注明:表演动作与节奏可迁移,但不得覆盖目标人物的身份特征。

当提示词明确定义情绪变化次序时,混合情绪才更易被识别:眼神先亮起,双肩随之放松,浮现一丝几不可察的微笑,最终重归沉着。
在附加媒体前,请先查阅 Ref2V 与 FL2VA 决策指南。参考素材并非越多越好。相互冲突的面部角度、表情峰值或光照条件反而会削弱信号强度。对于简单肖像类生成,一张高辨识度的身份图像搭配一张专注的表演参考图,往往比一整文件夹相似素材更易于诊断问题。
修复空白、机械感或过度表演的面部
面部空白通常意味着提示词仅描述情绪状态,却未说明其变化过程。请补充触发条件及两个可见的生理线索。面部机械感常表现为持续直视、眨眼节奏过于精准、头部完全静止;应恢复自然呼吸、小幅视线调整及左右不对称性。面部过度表演则多源于重复使用高强度修饰语,例如“极度恐惧、震惊且崩溃”。请将其替换为一次克制的情绪转变,并设定否定边界:不皱眉、不瞪眼、不突然甩头。
若嘴部运动异常,请将无声反应与言语表达分离处理:让倾听者在对方台词进行中完成反应,稍作停顿,再简短回应。若情绪峰值时人物身份发生偏移,可减小镜头移动幅度、强化身份参考图权重,并简化表情设计。若结果忽略提示中细微措辞,请核查文本/视觉编码器与参考路径;Qwen 编码器精度指南详解了如何在不混淆量化设置与其他工作流变更的前提下,比对语义复杂提示的实际效果。
该现有 H3 参考生成视频结果仅为检验样本,非微表情基准测试。请完整审视其人物身份稳定性、视线方向、眨眼节奏,以及面部是否自然归位。
测试时,请固定输入内容、随机种子(seed)、时长、模型、分辨率及镜头指令。每次仅调整一个表情相关短语。推荐采用三轮测试序列:基线版 → 指令精简版 → 触发条件明确版。若更短提示词已奏效,则仅补充叙事必需的细节,而非恢复原始全部冗余描述。
在制作全流程中复核完整表演
请依据动态影像而非某张美化静帧批准情绪表达。以正常速度观看带声版本;关闭音频以判断节奏;仅听音频以判断语音节拍。需核查人物身份、视线方向、眨眼节奏、口型动作、头部运动、肩部张力,以及关键瞬间镜头是否足够贴近。

混合情绪无需戏剧化面部:眼神柔和、嘴角不对称运动、呼吸平稳,已足以承载整个场景。
对于多镜头场景,每完成一条通过审核的镜头后,请撰写情绪状态交接说明,例如:“通话前戒备”、“听到名字后开始释然”、“平静但仍存疑虑”。将选定的参考图、提示词、随机种子(seed)及验收备注与该镜头一并存档。Seedance Agent 可协助管理这些参考素材,规划恰当时机的特写镜头,汇总审阅意见,并仅重跑失败的表演片段,而非整段序列重新生成。当您希望在一个托管工作流中同时使用模型与模式时,请使用MiniMax H3 模型页面;若已有高质量人像(strong portrait)明确界定了演员,则可从“图像生成视频”(image-to-video)工作区入手。创意目标始终如一:实现细微而富有动机的面部变化,使其服务于叙事,同时不引起观众对生成过程本身的注意。
结论
高效的 MiniMax H3 微表情提示词,需将内在情绪转化为一段简短、可视的时间线:中性基线状态 → 明确的情绪触发点 → 两到三个协调一致的面部及肢体反应线索 → 受控的回归静止状态。确保镜头足够近以捕捉细节,为每个参考帧指定唯一角色,按播放顺序将反应置于对白周围,并剔除夸张或相互矛盾的指令。需分别在有声与无声条件下审阅完整片段,在镜头切换之间记录被采纳的情绪状态,并逐句迭代优化。当参考素材管理、时间点控制、审批流程及局部重跑成为更棘手的问题时,请使用 Seedance Agent 构建表演工作流,从而持续聚焦于演员最终呈现的精彩瞬间。

AI 视频聚合 API 与直连 API:选择合适的生产技术栈
在成本、控制力、故障转移能力、集成时间、可移植性以及经批准的输出质量等方面,对比统一 AI 视频 API 与直连供应商方案。
阅读文章
MiniMax H3 Qwen 编码器 INT8 与 INT4 对比:选择合适的精度
从显存占用、推理速度、提示词保真度、参考图处理能力及生产环境风险五个维度对比 MiniMax H3 Qwen 编码器的 INT8 与 INT4 版本。
阅读文章
MiniMax H3 商业许可证:能否将 H3 用于客户项目和已变现视频?
了解 MiniMax H3 针对开源权重、API 接入、适用地区、“2000 万美元”门槛、披露要求、客户项目及产品部署的商业使用规则。
阅读文章