- 블로그
- Vivideo AI 비디오 에이전트 튜토리얼: 브리프, 계획, 생성, 수정
AI 개요
Vivideo AI 비디오 에이전트는 무엇을 하나요?
대화형 브리프를 스크립트 및 장면 계획으로 전환하고, 제작 요소를 선택하며, 비디오를 렌더링한 후 수정 요청을 수용합니다. 출력물을 최종 산출물로 간주하기 전에 반드시 계획을 승인해야 합니다.
Vivideo 에이전트 비디오를 어떻게 시작하나요?
Agentic Chat을 열고, 하나의 대상 청중, 하나의 목표, 하나의 형식, 하나의 행동 유도 문구(Call to Action)를 설명하세요. 소스 자료, 브랜드 제약 조건, 지속 시간, 그리고 에이전트가 절대 창작해서는 안 되는 사항을 추가하세요.
렌더링 전에 계획을 편집할 수 있나요?
예. 생성 전에 각 장면의 지속 시간, 시각적 묘사, 음성 해설(Voiceover)을 모두 검토하세요. 아직 변경 비용이 낮은 단계에서, 근거 없는 주장, 약한 후크(Hook), 리듬 불일치, 연속성 문제 등을 바로잡으세요.
Seedance 에이전트를 사용해야 할 때는 언제인가요?
참고 자료 정리, 샷 단위 모델 선택, 승인 절차, 연속성 검사, 또는 다중 샷 제작 전체가 아닌 특정 샷만 재실행해야 하는 경우 Seedance 에이전트를 사용하세요. 즉, 자동 한 번 통과 방식이 아니라 세심한 제어가 필요한 경우입니다.
Vivideo AI 비디오 에이전트가 실제로 수행하는 작업
Vivideo의 에이전트는 전통적인 타임라인을 조작하기보다는 산출물을 설명하는 것을 선호하는 창작자를 위해 설계되었습니다. 공식 문서화된 프로세스는 생성 주변에서 발생하는 고비용 협업 작업을 포괄합니다: 요청 해석, 스크립트 작성, 장면 분할, 지속 시간 및 음성 해설 배정, 필요 시 아바타 또는 음성 선택, 렌더링, 그리고 대화 기반 수정. 핵심 차이점은 에이전트가 첫 번째 전체 렌더링 이전에 인간이 읽을 수 있는 계획을 제안한다는 점입니다.
그 계획은 “단 하나의 프롬프트”라는 표현보다 훨씬 중요합니다. 완성된 비디오는 짧은 프롬프트가 흔히 모호하게 남기는 여러 결정을 포함합니다: 시청자는 누구인가, 무엇을 이해해야 하는가, 각 샷에 어떤 요소가 등장하는가, 각 비트(beat)는 얼마나 오래 지속되는가, 내레이터가 무슨 말을 하는가, 마지막 행동 유도 문구는 어떻게 전달되는가. 에이전트는 이러한 결정들을 초안으로 작성할 수 있지만, 최종 승인 권한은 여전히 창작자에게 있습니다.

생성된 모든 프레임을 검토 대상 산출물로 취급하세요: 제품 기하학, 손 동작, 반사, 가독성 있는 액션, 나중에 자막을 위한 여유 공간 등이 모두 중요합니다.
Vivideo는 또한 Agentic Chat을 Auto-Generate 및 Manual 모드와 구분합니다. Agentic Chat은 대화 기반이며 수정 중심입니다. Auto-Generate는 단일 명령어로 안전하게 완전한 초안을 생성할 수 있을 때 더 적합합니다. Manual 모드는 이미 원하는 모델, 장면 구조, 음성, 출력 설정을 정확히 알고 있는 창작자를 위한 것입니다. 본 튜토리얼은 가장 명확한 승인 경계를 제공하는 Agentic Chat에 초점을 맞춥니다.
에이전트가 활용할 수 있는 브리프 준비
“훌륭한 홍보 영상을 만들어 주세요”라고 시작하지 마세요. 에이전트가 활용할 수 있는 간결한 제작 브리프를 제공하세요. 가장 유용한 입력은 청중, 목적, 근거, 형식, 지속 시간, 시각적 방향, 음성, 그리고 양보할 수 없는 제약 조건을 명시합니다. 비디오가 제품 페이지나 문서를 참조한다면, 사용 가능한 주장과 확인이 필요한 사실을 구분하여 명시하세요.
다음 시작 템플릿을 복사하세요:
[지속 시간] [화면 비율] 비디오를 [청중]을 위해 제작하세요.
목표: [시청자가 실행해야 할 하나의 행동].
핵심 메시지: [한 문장].
사용 가능한 근거: [승인된 사실만].
시각적 방향: [주제, 배경, 속도, 카메라 언어].
음성: [연설자 스타일, 언어, 에너지].
행동 유도 문구: [정확한 최종 행동].
유지: [브랜드 색상, 제품 형태, 캐릭터 정체성].
배제: [근거 없는 주장, 추가 로고, 시각적 클리셰].
렌더링 전에 전체 장면 계획을 승인용으로 제시하세요.

프레젠테이션 중심 작업의 경우, 추가 장면 요청 전에 인물의 정체성, 제품 잡는 방식, 시선 방향, 의상, 배경, 자막 삽입을 위한 안전 공간을 모두 승인하세요.
마지막 줄은 매우 중요합니다. 이는 계획 수립과 생성이 별개의 게이트(Gate)임을 에이전트에 명시합니다. 압축된 스크린샷 대신 깨끗한 소스 이미지를 첨부하고, 그 역할을 명시하세요: 제품 참조, 캐릭터 참조, 배경 영감, 또는 첫 프레임. 작업이 하나의 승인된 정지 이미지에서 시작된다면, 이미지-투-비디오 워크플로우가 가장 간단한 제작 경로입니다. 시스템에 소스 재설계와 동시에 애니메이션을 요청하지 마세요.
장면 계획 수립 및 승인
Vivideo는 각 계획된 장면을 세 가지 실용적 필드—지속 시간, 시각적 요소, 음성 해설—로 설명합니다. 이를 고립된 카드가 아니라 연결된 시퀀스로 검토하세요. 강력한 오프닝은 청중의 문제를 즉각적으로 드러내야 하며, 중간 부분은 장면당 하나의 유용한 포인트를 입증해야 하고, 결말은 구체적인 다음 행동을 포함해야 합니다.
| 계획 점검 항목 | 승인할 사항 | 수정할 사항 |
|---|---|---|
| 후크(Hook) | 첫 비트에서 청중과 문제가 명확히 드러남 | 일반적인 오프닝 또는 가치 제시 지연 |
| 지속 시간 | 각 장면이 해당 대사와 액션을 수행하기에 충분한 시간 확보 | 짧은 시각적 요소 위에 긴 음성 해설 |
| 시각적 요소 | 하나의 가독성 있는 주제와 하나의 주요 액션 | 한 샷 내에서 여러 경쟁적 액션 동시 존재 |
| 음성 해설 | 주장 내용이 승인된 소스 자료와 일치 | 창작된 수치, 보증, 기능 등 |
| 연속성 | 제품, 인물, 장소, 시간이 일관되게 유지됨 | 설명되지 않은 의상 또는 환경 변화 |
| CTA | 최종 행동이 명시적이고 현실적임 | 맥락 없이 “자세히 알아보기” 등 모호한 결말 |

*장면 계획은 컷 사이에서 시각적 앵커(Anchor)를 유지해야 합니다: 앞치마 색상, 조리대 배치, 패스트리 형태, 창문 방향, 따뜻한 낮빛 등이 모두 연속성 단서입니다.*타이머를 사용하여 음성 녹음본을 소리 내어 읽어 보세요. 구어로 전달되는 내용은 일반적으로 계획 상의 텍스트가 암시하는 것보다 더 많은 호흡 공간이 필요합니다. 만약 내레이션이 복잡하고 답답하게 들린다면, 촬영 시간을 늘리기 전에 먼저 해당 문장을 단축하세요. 그런 다음 시각적 요소가 실제로 말하는 내용을 뒷받침하는지 확인하세요. 제품 라벨의 클로즈업은 감성적인 라이프스타일 주장, 기술적 프로세스, 고객 성과라는 세 가지 주장을 동시에 입증할 수 없습니다.
멀티모델 제작의 경우, 어떤 장면에서 말하는 아바타, 제품 충실도, 영화 같은 동작, 혹은 단순한 그래픽 지원이 필요한지 기록하세요. 멀티모델 AI 비디오 워크플로는 하나의 생성기가 모든 씬을 담당해서는 안 될 때 유용한 라우팅 방법을 제공합니다.
챗을 통한 생성, 검토 및 수정
승인 후, 첫 번째 편집본을 생성하고 사운드를 켠 상태에서 배포 크기로 검토하세요. 스토리와 리듬을 위해 한 번, 이미지 결함을 위해 한 번, 오디오를 위해 한 번씩 전체 영상을 시청하세요. 첫 번째 시청 시에는 매 초마다 멈추지 마세요. 우선 전체 시퀀스가 의도한 메시지를 전달하는지 파악하세요. 두 번째 시청 시에는 정확한 장면, 타임스탬프, 결함, 그리고 원하는 변경 사항을 기록하세요.
이 독립적인 동작 예시는 Vivideo 렌더링으로 주장되지 않으며, 단일 제품 동작과 제어된 카메라 이동이 승인 절차를 어떻게 단순화하는지 보기 위한 용도입니다.
수정 요청은 프로덕션 노트처럼 작성하세요: “장면 2에서 병과 배경은 그대로 유지하고, 빠른 궤도 운동만 느린 20도 이동으로 교체하세요.” “더 나아지게 해 주세요”와 같은 모호한 표현은 피하세요. 하나의 요청에는 하나의 주요 변경 사항과 반드시 유지되어야 할 불변 요소(invariants)를 포함해야 합니다. 대본 수정 시에는 교체할 문장을 정확히 인용하세요. 타이밍 수정 시에는 목표 지속 시간을 명시하세요.
유용한 명령어 예시는 다음과 같습니다: “후크(hook)를 6단어로 단축하세요”, “장면 3에서 근거 없는 주장을 삭제하세요”, “모든 장면에서 동일한 화자와 음성을 유지하세요”, “장면 4만 더 넓은 구도로 재생성하세요”, “내레이션은 번역하되 제품명은 그대로 유지하세요”. 수정이 전체 브리프를 변경하는 경우, 진행 전에 승인된 버전을 복제하세요.

소셜용 모션의 경우, 프레임을 애니메이션 소스로 승인하기 전에 얼굴, 팔다리, 바닥 접촉, 배경 선, 캡션을 위한 여백을 검토하세요.
에이전트 모드, 자동 모드, 수동 모드를 언제 사용할 것인가?
브리프가 불완전하거나 여러 이해관계자가 계획을 승인해야 하거나, 대화형 수정이 예상될 경우 에이전트 챗(Agentic Chat) 을 사용하세요. 설명 영상, 제품 스토리, 소셜 캠페인, 지역화된 변형, 발표자 중심 영상 등 대본 및 장면 결정이 순수 생성만큼 중요한 경우에 적합합니다.
과제가 위험이 낮고 반복 가능할 경우 — 즉, 일상적인 요약, 내부 초안, 간단한 목록, 또는 실패 시 폐기 가능한 빠른 개념 영상 — 자동 생성(Auto-Generate) 을 사용하세요. 속도 향상이 장점이지만, 게시 전에 창작자는 여전히 주장 내용, 권리, 캡션, 음성, 시각적 일관성을 검증해야 합니다.
출력물이 특정 모델, 종횡비, 지속 시간, 해상도, 아바타 또는 참조 설정을 반드시 준수해야 할 경우 수동 모드(Manual mode) 를 사용하세요. 또한 자동 생성 중 특정 장면이 계속 실패할 경우, 수동 제어가 더 나은 복구 경로가 됩니다. 작업이 주로 직접 프롬프트-투-클립(prompt-to-clip) 생성이라면, Seedance의 텍스트-투-비디오 워크플로를 시작점으로 삼고, 프롬프트는 하나의 씬에 집중하도록 하세요.
적절한 모드는 기술적 자신감이 아니라 위험도에 따라 결정됩니다. 법적 주장을 포함하는 짧은 유료 광고는 5분 분량의 내부 교육용 초안보다 더 많은 제어가 필요할 수 있습니다. 가장 빠른 버튼을 선택하기 전에, 어디서 승인이 이루어져야 하는지, 무엇을 재생성할 수 있는지, 어떤 실패가 어떤 비용을 초래할지를 미리 결정하세요.
동일한 워크플로를 Seedance 에이전트로 이식하기
Vivideo의 대화형 흐름과 Seedance 에이전트는 관련 있지만 서로 다른 프로덕션 문제를 해결합니다. Vivideo는 스튜디오 내부에 에이전트를 두어 완전한 비디오를 초안 작성, 제작, 수정까지 수행하고 싶을 때 유용합니다. 반면 Seedance 에이전트는 참조 자료를 정리하고, 씬을 라우팅하며, 다양한 생성 방식을 비교하고, 승인된 결과를 보존하며, 큰 규모의 제작 중 실패한 부분만 다시 실행하고 싶을 때 특히 유용합니다.
이 별도의 동작 예시는 절제된 검토 대상을 보여줍니다: 안정된 컵 형태, 연속적인 증기, 미세한 카메라 움직임, 신뢰할 수 있는 타이밍.
실용적인 인수인계는 간단합니다. 승인된 브리프, 장면 테이블, 소스 파일, 음성 녹음본, 목표 종횡비, 그리고 변경해서는 안 되는 항목에 대한 메모를 저장하세요. 가장 강력한 정지 이미지나 클립을 가져온 후, 각 씬에 하나의 동작 목표를 할당하세요. 동일한 파일명과 승인 기준을 유지하여 프로듀서가 어느 버전이 승인되었는지 쉽게 식별할 수 있도록 하세요. 더 도구 중심의 에이전트 설정을 평가 중이라면, Higgsfield MCP 에이전트 가이드에서 대화형 계획(conversational planning)과 호출 가능한 에이전트 도구(callable agent tools)의 차이를 설명합니다.
동일한 정의되지 않은 문제에 대해 두 에이전트를 동시에 실행하지 마세요. 한 계층이 계획을 담당하고 승인 체크포인트를 설정하도록 하고, 다른 계층은 제어력이나 생성 품질을 높이는 데만 사용하세요. MiniMax Hailuo 에이전트 워크플로는 씬 계획과 모델 실행을 분리하는 또 다른 유용한 사례입니다.
결론유용한 Vivideo AI 비디오 에이전트 튜토리얼은 챗 박스를 찾는 데 초점을 두기보다는, 명확한 승인 경계를 설정하는 데 더 중점을 둡니다. 하나의 대상 청중과 하나의 목표로 시작하고, 장면 계획을 반드시 요구하세요. 지속 시간, 시각 자료, 음성 녹음, 주장 사항, 연속성 등을 검증한 후 생성합니다. 최초 편집본은 세 차례에 걸쳐 검토하고, 전체 프로젝트를 다시 시작하기보다는 명시적인 불변 조건(invariants)을 적용해 단일 장면만 수정하세요. 협업 기반 계획에는 Agentic Chat을, 위험이 낮은 초안 작성에는 Auto-Generate를, 이미 확립된 제작 통제가 필요한 경우엔 Manual 모드를 선택하세요. 작업 범위가 여러 참조 자료, 모델, 승인 절차, 그리고 선택적 재실행으로 확장될 때는 [Seedance Agent에서 제작을 계속하세요.
직접 해볼 준비가 되셨나요?
이 가이드의 단계를 Seedance에서 바로 적용해 프롬프트나 이미지를 몇 분 안에 완성도 높은 영상으로 바꿔보세요.
가입 시 무료 크레딧 제공. 요금제는 월 $20부터.

RunningHub Seedance 2.0 API 설정: 키, 자산, 첫 번째 호출
RunningHub Seedance 2.0 API를 설정하고, AI 앱 또는 ComfyUI 경로를 선택하며, 자산을 매핑하고, 작업을 폴링하며, 출력물을 저장하고, 일반적인 오류를 해결합니다.
글 읽기
ComfyUI에서 MiniMax H3 음성 프롬프트 사용법: 실제로 효과 있는 방법
ComfyUI에서 MiniMax H3가 기본 음성 프롬프트를 제공하지 않는 이유, 정확한 제외 항목 작성법, 노드 연결 점검 방법, 그리고 원치 않는 텍스트·인물·동작·오디오 문제 해결법을 알아보세요.
글 읽기
MiniMax H3 캐릭터 교체 워크플로우: 씬 유지
MiniMax H3 Ref2VA를 사용해 영상에서 캐릭터를 교체하면서 동작, 카메라, 환경 및 오디오를 보존합니다. 프롬프트를 복사하고 정체성 이탈을 수정하세요.
글 읽기