Midjourney Animate 上传图像教程:从静态帧到可用视频

E
Emma Chen·阅读约 1 分钟·Sep 16, 2026
分享到 X
Midjourney Animate 上传图像教程:从静态帧到可用视频

AI 概览

Midjourney 能否为从您电脑上传的图像生成动画?

可以。在网页版 Imagine 栏中上传图像,将其拖入 Animate(动画)插槽,然后选择手动或自动动画模式。该上传图像将成为一段五秒视频的第一帧。

应选择“低运动”还是“高运动”?

对于人像、产品、建筑及其他需最大程度保留原始图像特征的镜头,建议从 Low Motion(低运动)开始;当画面中存在明显主体动作或需要更强的镜头运动时,可选用 High Motion(高运动),但需接受更高的形变风险。

Midjourney 图像转视频提示词应描述什么内容?

应描述随时间发生的变化:主体动作、环境动态、镜头行为、节奏感,以及预期的最终定格画面(final beat)。避免重复陈述已由上传图像固定的所有视觉细节。

动画化后的图像最长能持续多久?

首次生成时长为五秒。每次扩展可增加四秒,最多可扩展四次,因此单段视频最长可达 21 秒;请在为下一段付费前,先确认并批准当前片段。

在动画化前准备上传图像

源帧承担了大部分连续性工作。一张干净的图像可为视频模型提供稳定的主体、可辨识的景深,以及更少需凭空生成的模糊细节。上传前,请检查面部、手部、重复图案、文字排版、精细的产品几何结构、反光区域,以及与画框边缘重叠的物体。在静态图中看似微小的缺陷,在动态中可能演变为令人分心的运动伪影。

请在生成前即按交付格式构图:为主体会朝向移动的方向预留空间;避免将关节恰好裁切在画框边缘;确保重要物体之间留有足够间距,以维持其形状完整性。若人像需转身,则应展现足够的肩部及背景信息,以便模型推断景深;若为产品展示镜头,则需在轮廓周围保留足够边距,防止推进(push-in)过早裁切物体。

一位手持红色雨伞的女性正穿过一条雨中的有轨电车街道,此图已作为干净的图像转视频起始帧完成准备。

一个实用的起始帧应具备:一个清晰的主体、明确的运动方向,以及足够丰富的环境,使镜头可在不凭空构建场景的前提下自由运动。

若单张参考图需支撑多个镜头,请在动画化前锁定所有创意决策:主体外观、服饰、地点、一天中的时段、镜头质感(lens feel)及色彩处理方式。将已批准的源图置于每一份输出旁以供比对。对于较长序列,应在生成运动前就规划好参考图与各镜头职能,避免一个优质帧最终生成五个互不关联的片段。

上传图像并选择合适的动画路径

使用网页版 Animate 插槽上传您自己的图像

在 Midjourney 网站上,从 Imagine 栏打开图像面板,上传或选择您的文件,并将其拖入 Animate 区域。这与将文件作为 Image Prompt(图像提示)、Style Reference(风格参考)或 Edit Model Reference(编辑模型参考)附加的方式不同——这些参考类型均非视频的起始帧输入。若您希望基于同一源图测试多个运动提示词,可将该图像固定(Pin)。

当您需要快速获得解释性结果时,可选择自动模式;当镜头具有特定动作、镜头运动或明确停顿点时,则应选择 Animate Manually(手动动画)。手动提示词通常是更优的制作路径,因其生成的是可反复修改的书面指令,而非同时调整多个变量。

Midjourney 的 Discord 路径也支持在提示词开头插入外部托管图像 URL,后接可选的运动描述文本及 --video 参数。对大多数上传文件而言,网页路径更为便捷,因其能直观呈现起始帧的角色定位。

让首次测试保持经济高效

视频提示词默认生成四个变体。若您正在验证一张新源帧,或对运动构思尚不确定,可通过 --bs 1 将批次数量减至一个。此举可将首轮运行转化为一次聚焦式测试,而非为四个重复相同构图错误的片段付费。仅当提示词与源帧均已确认无误后,再提升批次数量。相关 Midjourney 视频批处理尺寸指南 说明了一、二或四个输出分别适用的场景。

编写一个“增添时间感”而非“绘制第二张图”的运动提示词

一个有效的运动提示词应是一条简洁的镜头指令:说明谁或什么在运动、环境如何响应、镜头如何运作,以及最终定格于何处。上传图像已定义了服饰、建筑、配色与构图,因此重复这些名词反而会挤占对时间维度的描述空间。

请使用以下可直接套用的模板:

[主体动作],[次要环境动态],camera [镜头运动或固定位置],[节奏感],ending on [最终定格画面] --motion low|high --raw --bs 1

针对上述雨中电车起始帧,一次受控测试可写作:

她从容迈出两步并望向电车,细雨轻拂伞面,镜头保持稳定中景构图,节奏克制而自然,定格于电车在她身后缓缓减速的瞬间 --motion low --raw --bs 1

该动作具备可衡量性:两步、一次回望、一个抵达节拍;镜头指令明确;结尾为模型提供了方向性引导,而非要求无限延续的运动。“--raw”可通过减少额外创意解读,增强文字运动指令的影响力,但无法保证完全字面化的编舞效果。

对于需要更强物理过渡的提示词,请先描述一个主导性动作,再添加氛围元素。“电车驶过时转身”比一段包含转身、奔跑、缩放、环绕、骤雨、服装变换及人群反应的冗长描述更易评估。若您需将此类规划方法迁移至其他生成器,图像转视频提示词工作流 同样涵盖相同的“动作–镜头–结尾”结构。

Seedance 图像生成视频的运动示例,用于检验起始帧的连贯性

这是一个 Seedance 图像生成视频的示例,并非 Midjourney 输出。请观察清晰的起始构图如何为后续运动提供一致、可预期的演进方向。

根据失败代价选择“低运动”或“高运动”

“低运动”保护源图像

“低运动”是默认设置,更可能生成细微的主体动作、更稳定的镜头以及更缓慢的环境变化。对于人脸、时装、产品、建筑、食物等图像——即身份特征或几何结构比视觉奇观更重要的场景——这是合理的第一尝试。但该模式也可能表现不足,导致画面近乎静止;因此,请明确指定一个可见但幅度适中的动作。

同一辆雨中电车主题,以稳定构图呈现,适用于低运动动画测试。

针对“低运动”,请检查面部轮廓、雨伞辐条、电车几何结构,以及所要求的微小动作是否在不重新构图的前提下清晰可见。

“高运动”接受更多变化

“高运动”更可能同时带动镜头与主体运动。它适用于追逐、舞蹈、车辆驶过、揭示性镜头(reveals),以及能量感比严格帧面保真度更重要的场景。其权衡在于:解剖结构扭曲、表面滑移、背景不稳定,或镜头运动压倒预期动作的风险更高。请将其作为替代方案进行测试,而非自动升级选项。

女子随电车驶过而转身,体现了高运动测试中更大的动作幅度及更高的连贯性风险。

对“高运动”的审查应冻结片段中多个时间点,并比对物体结构,而非仅依据最富戏剧性的单帧做判断。

采用一条简单决策规则:选择能** visibly 完成镜头**的最低运动等级。若“低运动”完整保留了所有元素却缺乏活力,应先修改动词或镜头指令,再切换模式;若“高运动”实现了所需动作却破坏了主体,则需简化源图像构图,或将动作拆分为新镜头。“多关键帧工作流”在中间姿态需精确控制时往往更优。

仅扩展已验证有效的片段

Midjourney 初始生成一段五秒视频。每次扩展增加四秒,最多可扩展四次,最终达 21 秒。其中,“自动扩展(Extend Auto)”沿用原始提示词;“手动扩展(Extend Manual)”则允许您为下一段更改指令。实用的制作习惯是:先确认当前终点有效,再增加时长

请以正常速度及逐帧方式检查最后一秒:面部是否仍保持一致?手部与物体是否稳定?镜头是否抵达可自然延续的位置?主体是否存在合理的后续动作?若终点薄弱,扩展通常会放大而非修复该缺陷。此时应优先重跑或裁剪。

将扩展指令写作“下一个节拍”,而非完整重写。例如:“电车平稳停靠,她收起雨伞,镜头缓缓拉开至更宽的固定构图。”此举既维持场景整体走向,又赋予该段落明确的收束感。详尽的 视频扩展工作流 展示了如何在源片段、延续段与最终交付之间保持无缝衔接。

同一人物抵达电车站并收起雨伞,呈现平静而完整的最终构图。

干净利落的最终定格,远优于在转身中途或镜头甩动瞬间截取的帧。

对于多镜头作品,请将已批准的起始帧、选定片段、提示词、运动设置、批处理大小及扩展历史一并保存为一个完整包。在 Seedance Agent 的参考视频工作流(reference-to-video) 中,这些资产可始终关联于镜头计划,便于您横向比对输出、择优批准,并仅重跑失败的片段。

排查上传图像最常见的失败情形

视频几乎无运动

一个可观测的动词一个环境线索替换模糊的氛围描述。“电影感的雨天氛围”未指明运动;“她转向电车,雨滴自伞面滑落”则明确具体。首次修订请坚持使用“低运动”;仅当指令更清晰后仍表现不足,才尝试“高运动”。

面部、手部或产品发生形变

减少同步发生的动作,避免极端镜头环绕,并在源图像中为细小细节分配更多像素。若上传图像中某关键观察点(如指尖、商标)尺寸极小,动画模型便缺乏足够结构信息予以保留。此时应重新构图,或单独拍摄特写镜头,而非强求广角镜头在动态中承载细节。

镜头无视提示词

明确声明单一镜头行为:固定镜头、缓慢推进、柔和横摇,或跟拍移动。切勿在一条指令中混用“静态”“手持”“环绕”和“缩放”。启用 --raw 参数时提示词影响力或有提升,但源图像构图仍从根本上约束着合理运动范围。

扩展片段在接缝处出现跳变

返回上一段干净的片段,选取一个低运动且几何结构稳定的终点。延续既有动作,而非立即反转方向。若接缝仍明显,请将扩展视为全新镜头,并通过有意设计的硬切(cut) 隐藏过渡,而非反复扩展一个已断裂的衔接点。

结论要在 Midjourney 中为上传的图像生成动画,请准备一个具备清晰景深与运动空间的帧,将其放入 Animate 插槽中;在提示词中描述一个可见的动作及一种摄像机行为,并用 --bs 1 进行测试。当连续性至关重要时,请从 Low Motion 开始;当场景可容忍一定变化时,可使用 High Motion;仅对已处于稳定状态的端点进行延伸。在生产流程中,请将源图像、提示词、选定的成片(take)以及延伸历史一并保存;随后通过 Seedance Agent 构建完整序列,以确保审批记录与选择性重跑始终关联至正确的镜头。

准备好亲自试试了吗?

在 Seedance 中实践本指南的步骤,几分钟内将提示词或图片变成精致视频。

注册即送免费积分,套餐每月 $20 起。