Vivideo AI ビデオエージェントチュートリアル:Brief、Plan、Generate、およびRevise

E
Emma Chen·読む時間: 約1分·Sep 10, 2026
Xで共有
Vivideo AI ビデオエージェントチュートリアル:Brief、Plan、Generate、およびRevise

AI の概要

Vivideo AI ビデオエージェントとは何をするものですか?

会話形式の brief(要件定義)をもとに、脚本およびシーン構成計画を作成し、制作要素を選択・動画レンダリングを行い、さらに修正リクエストにも応じます。出力結果を最終的なものとして扱う前に、必ず計画内容をご確認・承認ください。

Vivideo エージェントによるビデオ制作を開始するにはどうすればよいですか?

Agentic Chat を開き、1 つの対象オーディエンス、1 つの目的、1 つのフォーマット、および 1 つの行動喚起(Call to Action)を記述してください。さらに、ソース資料、ブランド制約、動画の所要時間、およびエージェントが絶対に「でっち上げてはならない」事項を追加します。

レンダリング前に計画を編集できますか?

はい。生成処理を実行する前に、各シーンの所要時間、視覚的描写、ナレーション(ボイスオーバー)をすべて確認できます。未サポートの主張、弱いフック(導入部)、テンポのギャップ、連続性の問題などは、変更コストがまだ低い段階で修正可能です。

Seedance Agent を使用すべき場合はいつですか?

参照資料の整理、ショット単位でのモデル選択、承認プロセス、連続性チェック、あるいはマルチショット制作における一部ショットのみの再実行が必要な場合に、Seedance Agent をご利用ください。一方、Vivideo は単一の自動パスで完結する作業に向いています。

Vivideo AI ビデオエージェントが実際に実行すること

Vivideo のエージェントは、「従来型のタイムライン操作」よりも「成果物の要件を言語化すること」を好むクリエイター向けに設計されています。公式ドキュメントで明記されているワークフローでは、生成に伴う高コストな調整作業全体がカバーされています:リクエストの解釈、脚本作成、シーン分割、各シーンの所要時間とナレーションの割り当て、必要に応じたアバターまたは音声の選択、レンダリング、そして会話ベースの修正。最も重要な特徴は、最初のフルレンダリングの前に、人間が読み取れる形の計画案を提示する点です。

この計画案は「1 回のプロンプト」というフレーズよりも重要です。完成した動画には、短いプロンプトでは曖昧になりがちな複数の意思決定が含まれています:視聴者は誰か? 何を理解してほしいのか? 各ショットに何が映るのか? 各ビートの長さはどれくらいか? ナレーターは何を話すのか? 最終的な行動喚起(CTA)はどのように機能するのか? エージェントはこうした意思決定を草案できますが、最終的な承認権限はあくまでクリエイターにあります。

コバルト色のトラベルスピーカーが濡れた市街地の屋上に置かれた、シネマティックなクリエイター主導の製品発表シーン

生成されたすべてのフレームを、検査可能な成果物として取り扱ってください:製品の形状、手の動き、反射、読み取り可能なアクション、および後続のキャプション挿入用の余白——これらすべてが重要です。

また、Vivideo は Agentic Chat、Auto-Generate、Manual モードを明確に分離しています。Agentic Chat は会話型かつ修正主導型です。Auto-Generate は、単一の指示で安全に完成原稿を生成できる場合に適しています。Manual モードは、すでに使用モデル、シーン構造、音声、出力設定を熟知しているクリエイター向けです。本チュートリアルでは、最も明確な承認境界を提供する Agentic Chat に焦点を当てます。

エージェントが活用できる Brief(要件定義)の準備

「素晴らしいプロモーション動画を作ってください」というような曖昧な依頼から始めないでください。代わりに、簡潔な制作 brief(要件定義)をエージェントに提供してください。最も有用な入力情報には、対象オーディエンス、目的(ジョブ)、根拠(証拠)、フォーマット、所要時間、ビジュアル方向性、音声、および絶対に守らなければならない制約が含まれます。動画が製品ページや文書を参照する場合は、どの主張を引用可能か、またどの事実を確認済みとするかを明示してください。

以下のテンプレートをコピーしてご利用ください:

[duration] [aspect ratio] の動画を [audience] 向けに作成してください。
目的:視聴者が取るべき [one action the viewer should take]。
核となるメッセージ:[one sentence]。
使用可能な根拠:[approved facts only]。
ビジュアル方向性:[subject, setting, pace, camera language]。
音声:[speaker style, language, energy]。
行動喚起(CTA):[exact final action]。
保持事項:[brand colors, product shape, character identity]。
禁止事項:[unsupported claims, extra logos, visual clichés]。
レンダリング前に、完全なシーン計画を承認のために提示してください。

自然なキャンプ場のシーンでコンパクトなランタンを紹介するフィクションのアウトドアクリエイター

プレゼンター主導の制作では、追加のシーンを依頼する前に、人物のアイデンティティ、製品の持ち方、視線の向き、衣装、背景、およびキャプション挿入に安全な余白をすべて承認してください。

最後の一行は非常に重要です。これにより、計画立案とレンダリングが明確に分離された「ゲート(関門)」であることがエージェントに伝わります。圧縮されたスクリーンショットではなく、高品質なソース画像を添付し、その役割を明記してください:製品参照用、キャラクター参照用、背景のインスピレーション用、または最初のフレーム用。作業が 1 枚の承認済み静止画から始まる場合は、image-to-video workflow が最もシンプルな制作ルートです。システムに対して、ソース画像の再デザインと同時のアニメーション生成を依頼しないでください。

シーン計画の構築と承認

Vivideo は、各計画シーンを「所要時間」「視覚的描写」「ナレーション(ボイスオーバー)」という 3 つの実用的なフィールドで記述します。これらを個別のカードではなく、相互に関連した連続的な流れとしてレビューしてください。強力なオープニングは、視聴者の課題を即座に可視化すべきであり、中盤は各シーンで 1 つの有用なポイントを証明すべきであり、エンディングは具体的な次のアクションを含むべきです。

計画チェック項目 承認すべき内容 修正すべき内容
フック(導入) 最初のビートで、対象オーディエンスと課題が明確に示されている 一般論的なオープニング、または価値提示が遅れている
所要時間 各シーンが、そのナレーションとアクションを実行するのに十分な時間が確保されている 短い視覚表現に対して長いナレーションが流れる
視覚的描写 1 つの読み取り可能な被写体と 1 つの主要なアクションが存在する 1 つのショット内に複数の競合するアクションが存在する
ナレーション(ボイスオーバー) 主張内容が承認済みのソース資料と一致している 想定・でっち上げの数字、保証、機能など
連続性 製品、人物、ロケーション、時間の流れが一貫している 衣装や環境の変化が説明されていない
CTA(行動喚起) 最終的なアクションが明示的かつ現実的である 「詳しく知る」など、文脈なしの曖昧なエンディング

昼光が差し込むキッチンで、ベーカーが柑橘系ペストリーを並べる温かみのあるドキュメンタリー風フレーム

*シーン計画は、カット間で視覚的なアンカー(固定要素)を維持すべきです:エプロンの色、カウンターのレイアウト、ペストリーの形状、窓の向き、暖かい昼光——これらすべてが連続性の手がかりとなります。*タイマーを使ってナレーションを音読してください。口頭で話す言語は、通常、プラン上のテキストが示唆するよりも多くの「呼吸の余裕」を必要とします。ナレーションが詰まったように聞こえる場合は、ショットの持続時間を延長する前に、まず行を短くしてください。その後、映像が実際にその言葉を裏付けているかどうかを確認してください。製品ラベルのクローズアップは、感情的なライフスタイル主張、技術的プロセス、顧客成果という3つの異なる主張を同時に証明することはできません。

マルチモデル制作の場合、どのシーンにスピーキングアバター、製品の忠実度、シネマティックなモーション、あるいは単純なグラフィック支援が必要かを記録してください。マルチモデルAI動画ワークフローでは、1つのジェネレーターがすべてのショットを担当すべきでない場合に有効なルーティング手法を提供しています。

チャットによる生成・レビュー・修正

承認後、最初のカットを生成し、サウンドをオンにして配信サイズでレビューします。1回目は物語の流れとペーシングに注目し、2回目は画像の欠陥に、3回目はオーディオに注目して視聴してください。1回目の視聴中は、毎秒一時停止しないでください。まずは、このシークエンスが意図を正しく伝達しているかどうかを把握しましょう。2回目の視聴では、正確なシーン、タイムスタンプ、欠陥、および望ましい変更内容をメモしてください。

ジオメトリとカメラ移動のレビュー用製品モーション例

この独立したモーション例はVivideoレンダリングであるとは主張されていません。単一の製品アクションと制御されたカメラ移動が、承認プロセスをいかに簡素化できるかを確認するためにご活用ください。

修正依頼は、プロダクションノートのように記述してください。「シーン2ではボトルと背景を変更せず、高速オービットのみをゆっくりとした20度の移動に置き換えてください。」といった具合です。「もっと良くしてください」といった曖昧な指示は避けてください。1つの依頼には、1つの主要な変更と、必ず維持しなければならない不変要素(invariants)を含める必要があります。脚本の編集では、置き換える行を正確に引用してください。タイミングの編集では、目標となる持続時間を明記してください。

有用なコマンド例:

  • 「フックを6語に短縮してください」
  • 「シーン3の根拠のない主張を削除してください」
  • 「すべてのシーンで同じ話者と声質を維持してください」
  • 「シーン4のみをよりワイドな構図で再生成してください」
  • 「ナレーションを翻訳してください。ただし製品名はそのまま保持してください」

修正によって全体のBriefが変更される場合は、作業を進める前に承認済みバージョンを複製してください。

ガラス張りの交通ターミナル内で鮮やかに踊るダンサーのフレーム(明確なモーションスペースあり)

ソーシャル向けモーションでは、キャプションのための顔・四肢・床との接触・背景のライン・空白領域を確認し、アニメーションソースとして承認する前にフレームを検査してください。

アジェンティック/オート/マニュアルモードの使い分け

アジェンティックチャットは、Briefが未完成である場合、複数のステークホルダーが計画を承認する必要がある場合、または会話形式での修正が予想される場合に使用します。これは、説明動画、製品ストーリー、ソーシャルキャンペーン、ローカライズ版、プレゼンター主導型動画など、脚本およびシーンの決定が、単なる生成品質と同程度に重要となる用途に最適です。

オートジェネレートは、リスクが低く反復可能な課題に使用します:定例の要約、社内向けドラフト、シンプルなリスト、あるいは失敗しても破棄可能な迅速なコンセプトなどです。利点はスピードですが、公開前にクリエイター自身が主張内容・権利・キャプション・声・視覚的整合性を検証する必要があります。

マニュアルモードは、出力が既知のモデル・アスペクト比・持続時間・解像度・アバター・参照設定に厳密に従う必要がある場合に使用します。また、自動生成で1つのシーンが繰り返し失敗する場合のリカバリ手段としても、マニュアル制御が優れています。タスクが主に「プロンプト→クリップ」の直接生成である場合、Seedanceのtext-to-video workflowから始め、プロンプトは1ショットに焦点を当ててください。

適切なモードは、技術的自信ではなく、リスクによって決まります。法的主張を含む短い有料広告は、5分間の社内トレーニング用ドラフトよりも厳密な制御を必要とするかもしれません。最も速いボタンを選ぶ前に、どこで承認が必要か、何を再生成可能か、そして失敗がどのようなコストを伴うかを明確に判断してください。

同じワークフローをSeedance Agentへ持ち込む

Vivideoの対話型フローとSeedance Agentは、関連はあるものの異なる制作課題を解決します。Vivideoは、スタジオ内にエージェントを配置して、完全な動画の草案作成・構築・修正を行いたい場合に有効です。一方、Seedance Agentは、参照資料の整理・ショットのルーティング・生成アプローチの比較・承認の保存・大規模制作のうち失敗した部分のみの再実行をしたい場合に特に有用です。

連続性とタイミングのレビュー用、控えめなカフェモーション例

この別のモーション例は、抑制されたレビュー対象を示しています:安定したカップのジオメトリ、途切れのない蒸気、小さなカメラ移動、そして信じられるタイミングです。

実用的な引継ぎはシンプルです。承認済みのBrief、シーンテーブル、ソースファイル、ナレーション音声、ターゲットアスペクト比、および変更してはならない事項に関するメモを保存してください。最も強い静止画またはクリップをインポートし、各ショットに1つのモーション目標を割り当てます。ファイル名と承認基準をそのまま維持することで、プロデューサーがどのバージョンが承認済みかを明確に識別できます。よりツール駆動型のエージェント構成を評価している場合、Higgsfield MCP agent guideでは、対話型計画と呼び出し可能なエージェントツールの違いについて説明しています。

同じ未定義の問題に対して両方のエージェントを同時に実行しないでください。1つのレイヤーが計画を所有し、承認チェックポイントを確立し、もう1つのレイヤーは、制御性または生成品質を高める場所でのみ使用してください。MiniMax Hailuo agent workflowも、ショット計画とモデル実行を分離する有用な事例の1つです。

結論実用的な Vivideo AI 動画エージェントのチュートリアルは、チャットボックスを見つけることよりも、明確な承認境界を設定することに重点を置くべきです。まず、1つの対象オーディエンスと1つの目標から始め、シーンプランを必須とします。再生時間、ビジュアル、ナレーション、主張内容、および連続性を確認したうえで生成を行ってください。最初の編集版(ファーストカット)は3回のパスでレビューし、プロジェクト全体を再起動するのではなく、明示的な不変条件(invariants)を指定して1つのシーンだけを修正してください。共同での企画には「Agentic Chat」、リスクの低いドラフト作成には「Auto-Generate」、既知の制作コントロールが必要な場合は「Manual mode」を選択してください。作業が複数の参照資料、モデル、承認プロセス、および選択的再実行へと拡大した場合、Seedance Agent で制作を継続してください

自分でも試してみますか?

このガイドの手順をSeedanceでそのまま試し、プロンプトや画像を数分で完成度の高い動画に変えましょう。

登録で無料クレジット。プランは月額$20から。