Vidu 参考图像生成视频提示词指南:公式、示例与一致性修复

E
Emma Chen·阅读约 1 分钟·Sep 8, 2026
分享到 X
Vidu 参考图像生成视频提示词指南:公式、示例与一致性修复

AI Overview

Vidu 视频参考提示词应包含哪些要素?

为每张图像指定角色,描述一个可见动作,说明摄像机行为,设定场景与光照,并明确哪些元素必须保持不变。每条指令都需可在最终成片中验证。

Vidu 最多可使用多少张参考图像?

Vidu 当前的创作页面说明支持 1 至 7 张参考图像。仅使用能提供独特人物身份、物体、服饰、环境或风格约束的图像。

如何在 Vidu 中保持角色一致性?

采用清晰且视角兼容的图像,并重复一段简短的身份锁定描述,涵盖面部、发型、服装、剪影及标志性道具。减少干扰性主体、指代模糊的代词以及不必要的镜头切换。

Seedance Agent 是否支持多参考图像工作流?

可以。Seedance Agent 可将简要说明与参考图像转化为可审阅的分镜方案,为每个镜头绑定约束条件,并仅重新生成未通过连贯性或运镜审查的输出片段。

Vidu Reference to Video 提示词必须控制的关键要素

将每张图像视为制作资产

搜索 Vidu 视频参考提示词 的用户,需要的是能向模型阐明每张上传图像用途的提示词。Vidu 当前工作流支持人物、物体与场景类参考图像;其创作页面说明支持 1 至 7 张图像。7 张质量薄弱的参考图并不天然优于 3 张清晰明确的图像。

动笔前,请为每张图像赋予私有标签:人物 A、人物 B、产品、地点、服饰或风格。再判断该图是硬性连续性锚点,还是松散的视觉影响源。正面肖像可用于锁定面部特征;全身照可保障剪影与着装;地点图像则确立建筑结构与光照条件。若两张图像彼此矛盾,提示词将无法可靠消解冲突。

视频参考工作区 是组织此类任务最直接的入口。若您仅有一张源静态图,可先使用更基础的 图生视频工作区,再逐步添加更多约束。

一位身穿芥末色雨衣的女性,身旁是一只白色灵缇犬(右耳为黑色)和一只钴蓝色行李箱,伫立于驶过的列车旁

本指南所用的参考引导式概念成片。其中女性、芥末色雨衣、单黑耳灵缇犬、钴蓝色行李箱、湿漉漉的站台及银色列车均为连续性锚点。

生成前明确定义成功标准

在提示词旁列出五项验收检查项:同一女性、犬只毛色标记、雨衣、行李箱几何形态、滨海车站。运镜与构图可变化,但上述锚点不可更改。此举可将“感觉不对”转化为精准修订要求,例如:“恢复犬只右耳黑色,并保留行李箱的棕褐色肩带。”

五部分提示词公式

1. 参考图像角色与连续性锚点

以精炼的角色表开篇:“图像 1 用于女性面部与齐耳短发;图像 2 用于芥末色雨衣;图像 3 用于白身单黑耳灵缇犬;图像 4 用于钴蓝色行李箱及棕褐色肩带。”当画面中存在两个可能主体时,避免使用指代模糊的代词。

2. 单一动作,具备清晰起止

描述一个能在指定时长内完成的动作:“列车停稳,女性蹲下为灵缇犬系上牵引绳,随后起身,车门开启。”相比在一段短片中同时要求抵达、登车、交谈、环绕运镜与离场,此方式更易控制。请为动作设定结束姿态,避免最后一秒陷入随机运动。

3. 摄像机、场景、光照与锁定行

注明景别与一项摄像机运动:“中远景、平视角度,缓慢推进。”结尾添加锁定行:“保持面部身份、犬只毛色标记、雨衣颜色、行李箱形状、车站建筑结构及画面方向;禁止出现重复肢体、替换道具、文字或标识。”

同一位女性在钴蓝色行李箱旁为同一只灵缇犬系上牵引绳

第二张成片帧变更了动作与摄像机距离,但仍保留选定的人物、动物、服饰、行李及地点锚点。

可直接复制粘贴的 Vidu Reference to Video 提示词

人物、动物与地点提示词

“参考图 1 用于女性面部、齐耳黑发及身体比例;参考图 2 用于芥末色雨衣、黑色靴子与双肩包;参考图 3 用于身形修长的白色灵缇犬(右耳为黑色);参考图 4 用于钴蓝色硬壳行李箱(配一条棕褐色竖向肩带);参考图 5 用于潮湿的滨海火车站台。一列银色列车自右向左平稳驶入。女性蹲下,将棕色牵引绳扣至犬只项圈,望向开启的车门,随后起身。中远景、平视角度,缓慢推进;雨后柔和晨光,写实级运动表现。严格保留所有已命名锚点、女性双手、犬只解剖结构及画面方向;前景不得出现新人物,禁止文字与标识。”

若生成结果不佳,可先移除一张非关键的服饰或背景图像,再增加文字描述。

产品几何形态提示词

“以参考图1为精确产品:哑光珊瑚橙色保温瓶,黑色环形瓶盖,窄银色瓶颈,浅奶油色多线波纹带,比例保持不变。以参考图2为湿玄武岩瀑布环境。一名徒步者的手伸入画面并提起水瓶,水花在瓶底四溅。低角度近景拍摄,镜头轻微前移,产品清晰锐利,瀑布背景柔和虚化,晨雾清冷,瓶身边缘泛出暖光。每一帧均须保持瓶盖形状、瓶颈宽度、波纹带位置、表面质感及颜色一致。不得出现标签文字、Logo、凹痕、重复水瓶、手指扭曲或色彩偏移。”

一只手持向瀑布旁的珊瑚色保温瓶

成品产品镜头便于直观检验几何结构、色彩、瓶盖构造、手部接触及环境动态。

双角色互动提示词

“参考图1为角色A:一位身穿炭灰色围裙的厨师;参考图2为角色B:一位身穿钴蓝色夹克的骑行者;参考图3为铺有绿色瓷砖的小型开放式厨房。角色A将一只陶瓷碗沿操作台滑出;角色B用双手接住碗并微笑。固定中景双人构图,一次轻柔的焦点转移——从碗过渡至角色B,光线为温暖的窗光。全程保持双方面部特征、发型、服饰、相对身高、碗上图案、操作台布局及左右位置关系一致。禁止换脸、多余手指、服装变化、对话文字或镜头切换。”

如需进一步了解参考系统与单图生成器的区别,请参阅Vidu 替代方案指南。该指南有助于将访问权限与产品选择问题,与本文所探讨的提示词设计问题明确区分开来。

选择并标注参考图像

使用互补视角,而非高度相似图像

一套有效的角色参考应包含一张正面像、一张三分之四侧面像及一张全身着装像;一套产品参考可采用主视觉角度、侧视图及手部接触图;场景参考则宜选取一张广角全景图,再加一张需在特写镜头中保留的关键细节图。

裁剪时去除背景杂乱元素,但务必保留用于判断尺度的关键细节。避免使用重度美颜滤镜、极端畸变、手部被遮挡、产品边缘模糊不清或界面元素(如UI控件)等图像。为保存的参考图赋予稳定易辨的名称,例如 MAYA_YELLOW_COATCORAL_BOTTLE_V1

提示词需匹配目标画面构图

若原始参考图为紧凑肖像,则不应要求快速全身影旋转并展现未见的服装细节。应从接近参考图的构图起步,先确认身份与几何结构准确无误,再逐项扩展——例如逐步增加摄像机距离或运动幅度。此方法可精准定位导致漂移的具体变量。

用于连续性审查的完成版车站运动样片

一段现有的 Seedance 编辑输出,并非官方 Vidu 基准测试。请在摄像机与人群持续移动过程中,同步审查主体面部、服饰、足部接触、背景车流及最终姿态。

修复身份、产品与场景漂移

先稳固身份,再添加风格

若人物在远距离下发生面部变化,可尝试拉近镜头、减少头部旋转、补充更强的三分之四视角参考,并缩短动作时长。仅重复使用最具辨识度的面部锚点。若服饰发生变化,应在角色列表中明确指定具体单品、颜色、材质与廓形,并在锁定指令中再次强调。若两名角色发生融合,需为其设定固定的左右位置及差异化动作。

产品漂移需用几何化语言描述,而非情绪化词汇。应明确说明瓶盖类型、提手结构、整体比例、标签位置、材质与颜色。仅指定单一接触事件(如提起或放下),并确保产品在画面中足够大、细节可辨。环境一致性指南提供了一套实用检查法,可用于评估建筑结构、道具、光线方向及空间连续性在不同构图中的稳定性。

同一珊瑚色保温瓶在移动的碎石自行车道上仍清晰可辨

变换的环境与运动中的摄像机,对同一瓶盖、瓶颈、波纹带、色彩与比例提出了更高难度的连贯性考验。

区分参考失效与运动失效

暂停输出视频,定位首个清晰帧。若此时身份或几何结构已出错,应优先修复参考图与提示词中的角色定义;若起始帧正确而后续帧发生漂移,则需降低动作复杂度、运动幅度、摄像机行程或总时长;若所有元素始终可识别但成片观感平淡,则应优化节奏、表演张力与摄像机动态。同时调整全部三层要素将丧失下一轮生成的诊断价值。

用于审查主体动作与节奏的完成版表演样片

一段独立的现有 Seedance 输出,专用于审查手部动作、乐器结构、表演节奏、摄像机距离及完整动态效果。

借助 Seedance Agent 扩展参考镜头规模

将提示词片段转化为受控的分镜计划

多参考视频生成的难点通常不在于首个提示词,而在于如何在整个序列中保持参考角色、已接受的构图、宽高比、镜头方向、审批意见以及重跑备注的一致性。粘贴的提示词可以描述单个镜头,却无法自动保留选择某参考的原因,也无法说明第四个镜头是哪个约束条件未达标。

Seedance Agent 从项目简报和源素材出发,先拟定脚本与分镜计划供审阅,再将每个参考精准绑定至其起关键作用的对应镜头。你可在付费生成前审批该计划,对比最终成片,并仅重跑薄弱片段,而非重建整个序列。多模型 AI 视频工作流 详解了不同镜头适配不同模型时,这种交接协作如何实现。

为任务选用正确的路径

当你想测试 Vidu 当前的 Reference to Video 模型、学习其参数响应方式,或制作一个受控的单条视频时,请直接使用 Vidu。当交付物包含多个镜头、多方干系人、多个版本或严格截止期,且制作过程记录与提示词本身同等重要时,请使用 Seedance Agent。无论采用哪条路径,均应保持参考标签与验收检查项一致,确保已审批资产可在工具间无缝迁移而不丢失语义。

结论

高效的 Vidu 参考图到视频提示词 就像精炼的制作指令:为每张图像明确指定角色,限定动作范围,命名唯一镜头运动,描述场景,并重复强调必须延续的连贯性锚点。起步时选用最少但兼容的参考图,在接近源构图的位置测试,再分别诊断身份、几何、运动与环境问题,之后才投入下一次生成。当创意演变为需审批与选择性重跑的多镜头交付物时,请从 Seedance Agent 开始,并将相同的参考标签与验收检查项纳入统一管理的工作流。

准备好亲自试试了吗?

在 Seedance 中实践本指南的步骤,几分钟内将提示词或图片变成精致视频。

注册即送免费积分,套餐每月 $20 起。