Seedance 2.5 で全ショットにわたって声を一貫させる方法

E
Emma Chen·読む時間: 約1分·Sep 4, 2026
Xで共有
Seedance 2.5 で全ショットにわたって声を一貫させる方法

顔が安定しているにもかかわらず、次のショットで声が年老いたり、速くなったり、アクセントが強くなったりすると、シーンは依然として不自然に感じられます。各声を「ロックされた制作資産」として扱いましょう:1つのクリーンなリファレンス音声を承認し、それを言葉で定義し、1人の話者に割り当て、そのルールを再利用します。本ガイドでは、この手法をプレゼンター、2人による会話、およびマルチショットのシークエンスにそれぞれ適用します。また、声のドリフト(変化)をリップシンクや録音の問題と明確に区別します。

AI 概要

Seedance 2.5 の各ショットで同一の声を維持するにはどうすればよいですか?

キャラクターに対して1つの承認済み・クリーンな声のリファレンス音声を用い、すべてのプロンプトで同一の話者ラベルおよび声の説明文を繰り返し使用します。変更するのは台詞、アクション、カメラ指示のみです。

Seedance の音声リファレンスには何を含めるべきですか?

1人の話者による短く乾燥した録音(無音の余白なし)、一定の音量、中立的な感情表現、そして音楽・反響・エフェクト・重なり合う発話のないものを選択してください。アクセント、ピッチ、話すペース、声の年齢が明確に聞き取れる必要があります。

キャラクターの声がクリップ間で変化するのはなぜですか?

ドリフトは通常、リファレンス音声が変更されたとき、プロンプトに矛盾する特徴が導入されたとき、感情表現が極端になりすぎたとき、あるいは拡張(エクステンション)を「次のビート」ではなく「新しいパフォーマンス」として扱ったときに始まります。

Seedance Agent は声の一貫性を支援できますか?

はい。Seedance Agent は brief(制作依頼書)を再利用可能な話者ルールに変換し、リファレンス役割をタスクに紐付けたまま保持し、有料生成を承認する前にプランをレビューできるようにします。

声の一貫性とは実際に何を意味するのか

視聴者は、言語やピッチだけではなく、音色(ティンブレ)、アクセント、リズム(キャデンス)、声の年齢、エネルギー、呼吸パターンを通して話者を認識します。有用なテスト法は、「画面を隠した状態で、視聴者がその人物を識別できるか?」を問うことです。

パフォーマンスの前にアイデンティティを固定する

恒久的な特徴とショットごとの演出指示を分離します。固定層の記述例:「温かみのある低〜中音域の女性の声、30代前半、ニュートラルなアメリカ英語、落ち着いたテンポ、わずかに質感のある音色」。パフォーマンスは「冷静」から「緊迫」へと変化しても、話者は置き換えられません。「美しい」「映画的」といった曖昧な形容は避けましょう。4つの聴覚的に明確な特徴を指定すれば、再現・評価が容易になります。

アイデンティティと録音品質を混同しない

同一人物の声であっても、次のクリップの音量が大きかったり、残響(ウェット)が強かったり、ノイズが多かったりすると、異なるように感じられることがあります。アイデンティティのドリフトと判断する前に、部屋のトーン(ルームトーン)、マイク距離、音量、周囲音(アンビエンス)を揃えてください。ネイティブ音声制作ガイドでは、セリフ、効果音、アンビエンスを明確に分離しています。

サムネイルではなくトランジションをレビューする

1つのショットの最後のフレーズを、次のショットの最初のフレーズに直接つなげて再生してください。カット(編集点)で明らかになることが多いのは、ピッチ・速度・アクセント・年齢・部屋の音のジャンプです。

広角インタビュー、中景、クローズアップのリアクションという異なる構図においても、口の形やパフォーマンスが変わっても同一話者が明確に認識可能

3枚のほぼ同一のフレームよりも、異なる構図の方が連続性をよりよく証明します。顔・衣装・部屋・声のアイデンティティは継続しつつ、パフォーマンスは進行すべきです。

再利用可能な Seedance 声リファレンスパックの作成

声リファレンスパックは、すべての新規ショットを同一の承認済み素材に基づかせるための、小さな「真実のソース」フォルダです。

話者ごとに1つのクリーンなリファレンスを承認する

静かな部屋で、完全な文を用いて8~15秒の自然な会話を録音し、マイク距離を一定に保ちます。クリッピング・音楽・残響・他の話者の声を除去します。単にサンプル長を延ばすために複数のテイクを接続しないでください。リファレンス内部に変化があると、回避したい「不一貫性」をAIに学習させてしまいます。

クリーンな昼間の声リファレンス録音は、1人の話者、1つのマイク距離、1つの中立的なパフォーマンスを捉えています

シンプルなリファレンスは、音楽・部屋の効果音・他の話者の干渉がないため、アイデンティティが明瞭に聞き取れます。

固定された声のアイデンティティカードを作成する

承認済みファイルの横に、簡潔なテキストカードを保存します:

  • 話者ID:MARA_01
  • 音色(ティンブレ):温かみがあり、わずかに質感のある低〜中音域
  • アクセント:ニュートラルなアメリカ英語
  • 声の年齢:30代前半
  • ペース:落ち着いたテンポ(約135語/分)
  • デリバリー:親密さと自信を伴う、歌唱なし
  • 変更不可:アクセント、ピッチ範囲、声の年齢、息遣いの強さ

このカードをそのまま再利用してください。Seedance 2.5 プロンプトガイドでは、固定制約と創造的演出指示をさらに明確に分離しています。

リファレンス役割を常に同一に保つ

ファイルを「気分」「サウンドトラック」「一般音声」ではなく、「声のアイデンティティ」としてラベル付けします。感情表現が優れていてもアクセントが異なるテイクは、パフォーマンスのガイドにはなり得ますが、アイデンティティのソースとしては絶対に置き換えてはなりません。

1人の一貫した話者向け、コピーレディなプロンプト形式

まず話者を固定し、次に台詞と可視アクションを記述します。カメラ指示は声のルールの後に配置し、新しい構図が新しいキャラクターと解釈されないようにします。

台詞の前に話者を固定する

同一の話者IDと表現を繰り返します。「落ち着いた」を「ゆっくりでスモーキーな」に変えると、声の年齢や音色が変化してしまう可能性があります。

SPEAKER LOCK — MARA_01  
添付の承認済み声リファレンスを、唯一の声のアイデンティティとして使用すること。  
維持:温かみのある低〜中音域の女性音色、30代前半の声の年齢、ニュートラルなアメリカ英語アクセント、  
落ち着いた135語/分のペース、親密さと自信を伴うデリバリー、自然な呼吸、歌唱なし。

SHOT 03 — 6秒、ミディアム・クローズアップ  
マラはインタビュアーの方を見ながら、正確に次のように言う:  
「最初のテストは成功しましたが、トランジションにはまだ1回のクリーンなパスが必要です。」  
感情:静かに安堵、強度3/10。話者は1人だけ。  
声のアイデンティティは変更せず、前のクリップと同一の部屋のトーンおよび音量に合わせること。  
カメラ:ゆっくりと5%のプッシュイン。カットなし、画外での会話なし。

各タイミングごとのビートに1つの発話タスクを与える

5秒間にささやき・笑い・顔の向き替え・高速カメラ移動をすべて詰め込まないでください。各クリップには1つの台詞、1つの感情レベル、1つの主なアクションを与え、リアクションは別途生成します。

パフォーマンス全体を評価する最初の音節、最も速いフレーズ、顔の向きの変化、および最終語を確認してください。失敗したフレーズまたはアクションのみを簡略化し、参照は固定したままにしてください。アセンブリおよび修復には、Seedance 動画編集ワークフロー を使用してください。

複数のキャラクターの声を明確に分離する

2人による対話では、2つの異なるアイデンティティを維持し、各台詞を正しくルーティングする必要があります。「文学的な散文」よりも、発話の順番(ターン)の所有権が明確であることが重要です。

固定された名前と人物ごとに1つの参照を使用する

MARA_01JONAH_01 のような安定した ID を作成してください。各 ID には承認済みの1つの音声を割り当て、並べ替えや名称変更は絶対に行わないでください。会話が始まると、「女性」と「男性」などの曖昧な表現は避け、常に固定名を使用してください。

各ショットで話者と聞き手を明示する

「Mara が話し、Jonah が無言で聞く」と記述し、その後に反応を指定してください。返答のショットでは、これらの役割を明示的に逆転させます。両者が同時に話す場合を除き、口の動きはアクティブな話者のみに限定してください。

完成したカフェでの対話シークエンスでは、同一の2人のキャラクターが維持され、ロケーションショット、Mara の発話、Jonah の返答が明確に分離されています

明確な話者/聞き手の配置(blocking)により、各声に所有者を割り当てることができ、編集はツーショットからショット–リバースショットへと展開されます。

難しいターンを個別のクリップに分割する

割り込み、話しながらの笑い、画外からの返答などはリスクが高い操作です。クリーンなターンを別々に生成し、反応のためのポーズ(一時停止)を確保してください。タイミングとカバレッジについては、複数キャラクター対話ガイド を参照してください。

Seedance ネイティブ音声対話サンプル · 声の所有権、口のタイミング、空間の連続性を確認

カットの前後だけでなく、各ショット内でも音声を聴き取ってください:説得力のあるやり取りには、明確に区別される声、同期された口の動き、そして1つの連続した音響空間が必要です。

声のドリフト、リップシンク、および延長に関する問題の修正

再生成を行う前に、問題がアイデンティティ、口のタイミング、話者のルーティング、あるいは音響環境のいずれに起因するかを特定してください。

症状 最も可能性の高い原因 対象とする修正
正しい声だが口のタイミングがずれている 台詞が過密、またはアクションが発話と競合している 文を短くする;首の向きの変化を減らす;声のロックを維持する
アクセントや声の年齢が変化している 矛盾する形容詞や極端な感情表現が混入 完全に同一のアイデンティティカードを復元;感情の強度を下げる
2人のキャラクターが同じ声を共有している 話者の所有権が曖昧 アクティブな話者を明示し、聞き手は無言であると明記する
延長部分が新たに録音されたように聞こえる ルームトーン、音量、または参照が変化した 承認済みのソースを再利用し、直前のクリップの音響プロファイルに一致させる
対話がメロディック(歌うような)になる 音楽の参照や「歌う」指示がプロンプトに漏れ込んだ 参照から音楽を完全に除外し、「歌唱禁止」の明示的なルールを追加する

声を置き換えずにリップシンクを修正する

アイデンティティが正しい場合は、それをそのまま維持します。音節数を減らし、高速な横顔への向き変化を制限し、最も難しいフレーズは正面を向いた明瞭なビート(拍)で配置します。口のタイミングを修正するために参照を変更すると、新たな問題が生じます。

1つの変数のみを変更してドリフトを修正する

最後に承認されたクリップ、元の参照、正確なアイデンティティカードに戻ります。失敗した台詞、感情、またはモーションのうち、1つだけを変更します。望ましくないメロディックな出力を回避するには、Seedance の歌唱を止める方法ガイド を参照してください。

クリーンなハンドオフから継続する

延長の場合、最終ポーズ、カメラの方向、話者 ID、感情、アンビエンス、音量を引き継ぎます。開始時に短い無音の反応を入れることで、小さな音響の差異を編集で隠す余地が生まれます。

繰り返し可能な声のワークフローとして Seedance Agent を活用する

声の連続性は、個々のプロンプトではなく、それらの上位にルールが存在するときに達成しやすくなります。Seedance Agent は、簡易な指示(brief)を、命名された話者、参照ロール、ショット単位の対話、および有料レンダリング前のチェックリストへと自動変換できます。これにより、矛盾する割り当て、未承認の参照、予期せぬアクセント変化などを、まだ無料で編集可能な段階で検出できます。

計画・承認・選択的再実行を行う

まず、納品物、キャスト、言語、所要時間、および声のカード(voice cards)を定義します。すべての発話ポイント(spoken beat)において、話者と聞き手の名前を明記します。最も難易度の高いテストケースを最初に承認し、成功した結果をロックします。たとえばショット4が失敗した場合、ショット4のみを修正し、すでに承認済みの3つのクリップは変更しません。

承認チェックリストを活用する

1回目:映像を見ずに音声のみでアイデンティティを確認;2回目:音を消して映像のみで口のタイミングを確認;3回目:映像と音声を同時に確認します。アイデンティティ、アクセント、ペーシング(話す速さ)、感情、リップシンク、ルームトーン、トランジション(切り替わり)の各項目を評価します。

どのワークフローも、世代間で完全に同一の波形を保証するものではありません。Agent は制約、参照、承認、再試行を可視化することで、意思決定を再現可能にします。

結論

キャラクターごとに1つのクリーンな参照を承認し、固定されたアイデンティティカードを使用し、すべての台詞を命名された話者に紐づけ、声・口の動き・ルームトーンをそれぞれ個別にレビューしてください。成功したクリップは保持し、失敗した1つの変数のみを一度に変更してください。こうしたルールを、参照、承認ゲート、選択的再実行、および統合仕上げを含む完全なマルチショット計画全体に適用するには、Seedance Agent を使って声の整合性を保ったプロジェクトを開始してください

自分でも試してみますか?

このガイドの手順をSeedanceでそのまま試し、プロンプトや画像を数分で完成度の高い動画に変えましょう。

登録で無料クレジット。プランは月額$20から。