- 博客
- ElevenLabs 配音每分钟成本(2026):V1 与 V2 计算器
AI 概览
ElevenLabs 配音每分钟收费多少?
当前 API 定价显示:Dubbing v1 带水印为 $0.33/源分钟,不带水印为 $0.50/源分钟;Dubbing v2 为 $2.20/源分钟。
收费依据是源视频时长还是配音后输出时长?
ElevenLabs 按源媒体时长向每种目标语言计费。一段 10 分钟的源视频配音成三种语言,即产生 30 个可计费的语言-分钟(language-minutes)。
ElevenLabs 是否对每种语言单独收费?
是的。创建项目时预付第一种目标语言费用;每增加一种语言,在排队时单独计费。首种语言不会重复计费。
Dubbing v1 和 v2 哪个更便宜?
v1 明显更便宜,且支持可编辑的 Studio 流程;v2 成本更高,但专为更直接地保留原始说话人的声音、情绪、节奏和表达而设计。
当前 ElevenLabs 配音每分钟成本
截至 2026 年 9 月,ElevenLabs 列出了三个实用的 API 价格档位。税费、附加费及关税未包含在内,企业协议价格可能不同。
| 路径 | 公布费率 | 10 分钟源视频 × 1 种语言 | 最适用场景 |
|---|---|---|---|
| Dubbing v1,自动处理(带水印) | $0.33/分钟 | $3.30 | 草案制作与低成本测试 |
| Dubbing v1,自动处理(无水印) | $0.50/分钟 | $5.00 | 可直接发布的自动输出 |
| Dubbing Studio v1 | $0.50/分钟 | $5.00 | 脚本与分段编辑 |
| Dubbing v2 | $2.20/分钟 | $22.00 | 更高保真度的表演还原 |
headline 费率仅是实用估算中的第一个数字。您的总成本还取决于源视频时长、目标语言数量、失败或重试的分段、清理耗时,以及本地化启动后主视频是否发生变更。
配音预算始于已锁定的源视频时长与所需语言版本数量——而非翻译脚本的长度。
若您仍在制作源视频,请先在 Seedance Agent 中统筹参考素材、镜头与审批流程,再支付本地化费用,避免为后续可能被替换的内容付费。
ElevenLabs 如何计算一个配音项目
按“源分钟数 × 目标语言数”计算
粗略估算公式如下:
源视频时长 × 目标语言数 × 每分钟费率 = 基础配音成本
一段 12 分钟的视频译为西班牙语、法语和日语,共产生 36 个可计费的语言-分钟。按公布的 v1 带水印费率计算,基础成本为 $11.88;按 v1 无水印或 Studio 费率计算,为 $18.00;按 v2 费率计算,则为 $79.20。
ElevenLabs 在创建项目时即对第一种目标语言计费。该笔付款用于准备源素材并预付首种目标语言费用。当首个目标语言排队时,系统将使用该预付款,不会再次扣款;其余每种新增目标语言则分别单独计费。
按完整源视频时长(而非说话时长)预算
计费依据为源媒体总时长。静音、片头音乐、停顿及非对白部分,仍计入上传资产的总时长。若从将配音至八种语言的源视频中裁剪掉一段不必要的 45 秒片头,即可减少 6 个可计费的语言-分钟。
因此,最有效的成本优化发生在上传之前:锁定剪辑版本、移除冗余场记点(handles)、明确哪些市场真正需要完整节目,并仅在服务于不同受众需求时才制作更短的区域化版本。
请使用语音清晰稳定、重叠较少、剪辑已锁定的干净源素材,以确保付费生成的语言版本不会继承本可避免的时间同步问题。
Dubbing v1 与 v2:更高费率所购买的价值
当编辑性与单位成本更重要时,选择 v1
Dubbing v1 是经济型方案。自动 v1 可识别说话人并快速生成目标语言版本;Dubbing Studio v1 则提供可编辑的项目工作流。当审阅者需修正人名、调整译句、更改说话人分配,或仅重生成特定分段时,此功能至关重要。
$0.33(带水印)路线适用于评估;$0.50(无水印)或 Studio 路线才是更贴近实际生产的对比基准——尤其当输出将正式发布时。切勿将带水印测试价格与最终交付要求直接比较,并据此推断整个项目均为 $0.33/分钟。
当表演还原度更重要时,选择 v2
Dubbing v2 采用端到端音频转音频方式,旨在跨语言保留说话人声纹、情绪、节奏与时间感。其定价为 $2.20/源分钟/语言,超过 v1 无水印费率的四倍。当前文档将 v2 描述为 Alpha 版产品,因此即使首版结果听感令人信服,也应预留质量审核预算。
在主网页界面中,自动 v2 不提供与 Dubbing Studio v1 同等的内置字幕编辑器。v2 的 API 编辑与重生成控制权目前仅限企业客户访问。因此,该选择不仅关乎“便宜 vs 优质”,更涉及“可编辑的 Studio 控制”与“更自动化的性能还原路径”之间的权衡。
多说话人内容应逐人审阅;单一声纹匹配良好,并不保证换人交接或重叠处理同样干净。
构建切实可行的配音成本计算器
从一个情景表格开始| 源视频与目标语言数量 | V1(带水印) | V1(无水印)/ Studio | V2 |
| --- | ---: | ---: | ---: | | 5 分钟 × 1 种语言 | $1.65 | $2.50 | $11.00 | | 10 分钟 × 3 种语言 | $9.90 | $15.00 | $66.00 | | 30 分钟 × 5 种语言 | $49.50 | $75.00 | $330.00 | | 60 分钟 × 10 种语言 | $198.00 | $300.00 | $1,320.00 |
以上为基于官方公布的每分钟费率计算得出的基础 API 费用,尚未计入税费及人工审核费用。自助式订阅方案可能包含不同额度的用量,但该运营公式仍有助于横向对比不同路径,并估算规模化成本。
增加返工余量(Rework Allowance)
切勿假设所有语言版本均能一次通过。请在内部预算中预留时间,用于文稿校正、发音复核、画面节奏对齐、音频混音及最终播放审验。这并不必然等同于再次支付整套平台费用:失败任务可能获得退款;而仅针对片段级的修正,其成本也通常低于整条内容的重新生成。但这些仍是真实发生的制作工时。
一份合理的规划表应包含:源视频时长、目标语言数量、所选模型、是否需添加水印、平台基础费用、审核人员工时、预期返工率,以及交付格式。请将平台支出与人工成本分开列示,避免因生成环节成本低廉而掩盖了审核流程的高昂开销。
在为更多语言付费前,先控制返工风险
锁定画面并优化源音频
请优先完成结构性剪辑。若在已生成六种语言版本后删除某个镜头,则团队已为过时内容付费,且须重新对齐全部交付物。请参考 Seedance 2.5 剪辑指南,在本地化启动前完成剪辑、延展与镜头替换。
尽可能将对白与高响度背景音乐分离,移除意外的环境噪音,避免多人同时讲话——除非该重叠本身具有叙事必要性。即便模型能出色保留人声特征,当两人语音交叠,或人名被音效掩埋时,仍可能导致配音混乱难辨。
制定验收检查清单
逐语言审核以下维度:语义准确性、专有名词与数字、说话人身份、发音、口型同步节奏、嘴部运动、背景音效、最终响度。对于由 AI 头像主导的节目,还需检查面部连贯性,以及停顿是否仍呈现自然意图。AI 头像视频工作流 提供了一条实用的制作路径,适用于主持人形象与讲话镜头需保持高度一致的场景。

完整的成本估算必须包含质量审查环节——它可及时发现说话人错配、术语误译、单词截断,以及令人分心的环境底噪突变。
Seedance 在多语言视频工作流中的定位
ElevenLabs 解决的是已有源视频后的语言本地化问题;而 Seedance 则介入更早阶段——即源视频、主持人镜头、辅助视觉素材、原生音频及成片终剪仍在开发之中时。将这些阶段明确区隔,可防止昂贵的配音流程沦为替代母版修复的权宜之计。
此真实 Seedance 输出展示了在母版送入多语言配音管线前,必须完成的对白与节奏校验。
对于以对白为主的源内容,请使用 原生音频指南 评估语音节奏与场景声效;若某位常驻发言人需在多个镜头中保持声线稳定,请参阅 声线一致性工作流,了解如何锁定声纹参照与连续性。请先批准该母版,再依据其最终时长核算 ElevenLabs 的用量。
Seedance Agent 在面向多区域本地化投放的营销活动中尤为高效:它可保留已批准的源镜头、分类管理各地区版本、仅重跑表现薄弱的视觉片段,并将母版与各类短视频变体统一归档。您仍需按每种语言的分钟数向配音服务商付费,但可显著降低因底层画面变更而导致重复付费的风险。
结论
一旦将路径选择、源视频时长与目标语言数量三者拆解开来,ElevenLabs 的每分钟配音成本便一目了然:V1 版本起价为 $0.33/源分钟(含水印)或 $0.50/源分钟(无水印);V2 版本标价为 $2.20/源分钟,且每增加一种目标语言,计费时长即相应倍增。V1 是低成本项目及可编辑 Studio 项目的务实之选;V2 则适用于对原始表演质感有更高要求、愿为此支付溢价的场景。请务必先锁定源视频剪辑、裁去冗余时长、测试一种代表性语言、并为审核环节预留预算,再行规模化扩展。如需在本地化前构建稳定可靠的视听母版,请参考 Seedance 参考工作流。

Midjourney Animate 上传图像教程:从静态帧到可用视频
学习如何在 Midjourney 中为上传的图像添加动画效果,选择“低运动”或“高运动”模式,编写运动提示词(motion prompt),延长视频片段,以及修复常见的连贯性失败问题。
阅读文章
Luma Dream Machine Extend 教程:构建更长镜头而不破坏连贯性
学习如何使用空白提示、定向提示、结束关键帧、干净交接、连贯性检查及选择性重运行来扩展 Luma Dream Machine 视频。
阅读文章
Synthesia AI 助理视频教程:从原始素材到可编辑草稿
学习如何使用 Synthesia Assistant,包括提示词(prompts)、文件、脚本、大纲、分镜脚本(Storyboard)修订、精准场景编辑,以及可靠的最终质量审核(QA)流程。
阅读文章