- 블로그
- MiniMax H3 멀티 키프레임 워크플로우: 타이밍, 연속성 및 전환 제어
AI 개요
MiniMax H3은 여러 키프레임을 지원하나요?
예. 로컬 ComfyUI에서는 MiniMaxH3AddGuide 노드를 연결하고 선택된 프레임 인덱스에 이미지 또는 오디오를 고정할 수 있습니다. 더 간단한 호스팅 방식은 시작/종료 프레임과 참조 자료에 중점을 둡니다.
MiniMax H3 비디오에는 몇 개의 키프레임을 사용해야 하나요?
필요한 스토리 상태를 정의하는 데 필요한 최소한의 앵커만 사용하세요. 일반적으로 시작 장면, 하나 또는 두 개의 전환 포인트, 그리고 종료 장면으로 구성됩니다. 불필요하게 추가된 충돌하는 프레임은 급격한 형태 변형(morph)을 유발할 수 있습니다.
키프레임 간 동일한 캐릭터를 유지하려면 어떻게 해야 하나요?
동일한 정체성 참조 자료를 재사용하고, 복장 및 환경 설명을 일관되게 유지하세요. 또한 각 키프레임이 주제 크기, 조명, 렌즈 방향, 화면 위치 측면에서 호환되어야 합니다.
이 워크플로우에는 ComfyUI과 Seedance Agent 중 어느 쪽이 더 적합한가요?
ComfyUI은 정확한 프레임 인덱스 및 노드 제어를 제공합니다. Seedance Agent는 샷 계획, 참조 자료 정리, 승인, 그리고 실패한 구간만 재실행하는 데 더 용이합니다.
MiniMax H3 멀티 키프레임 워크플로우가 실제로 제어하는 것
MiniMax H3 멀티 키프레임 워크플로우는 모델에게 특정 순간에 어떤 시각적 상태가 중요한지를 지시합니다. 키프레임은 타임라인 상의 특정 위치를 차지하며, 참조 이미지는 반드시 정확한 프레임이 되지 않더라도 정체성, 스타일, 움직임 또는 환경을 정의합니다.
키프레임과 일반 참조 자료의 차이
구성 요소가 특정 순간에 인식 가능해야 할 때 키프레임을 사용하세요. 예: 시작 시 닫힌 상자, 중간에 열리는 뚜껑, 끝에서 완전히 드러나는 모습 등입니다. 반면, 동일한 배우, 제품, 공간, 의상 또는 색상 체계가 다양한 구성 변화 속에서도 유지되어야 할 때는 참조 자료를 사용하세요. MiniMax H3 생성기는 참조 중심의 비디오 제작을 지원하지만, 로컬 그래프는 타이밍 제어를 보다 직접적으로 노출합니다.
모든 이미지가 종료 지점이 되면 H3는 행동 수행보다는 이미지 간 형태 변형(morph)을 시도할 수 있습니다. 반대로 모든 이미지가 단순한 느슨한 참조 자료라면 클립이 계획된 포즈에 도달하지 못할 수도 있습니다.
시작/종료 프레임과 중간 가이드의 차이
표준 시작 및 종료 프레임 방식은 두 개의 경계를 정의합니다. ComfyUI의 MiniMaxH3AddGuide은 선택된 frame_idx에 이미지, 짧은 클립, 오디오 신호 또는 오디오비주얼 가이드를 추가할 수 있으며, 여러 개의 가이드 노드를 연결해 여러 앵커를 설정할 수 있습니다. 이를 통해 하나의 생성 클립 내에서 진정한 3단계 또는 4단계 움직임이 가능해집니다.
중간 가이드는 필수적인 핵심 포인트에만 사용하세요. 손을 뻗는 동작은 별도 프레임 없이도 가능할 수 있지만, 제품이 한 위치에서 다른 위치로 이동하면서 완전한 상태로 도착해야 한다면 중간 가이드가 필요할 수 있습니다.

네 개 앵커로 구성된 제품 테스트는 병의 기하학적 형태, 유리 색상, 뚜껑, 돌 세팅, 리넨, 자연광을 모두 유지하면서 프레이밍이 최종 공개로 점진적으로 나아가야 합니다.
생성 전에 키프레임 계획을 수립하세요
최고의 결과는 짧은 타임라인으로부터 시작됩니다. 재생 순서대로 액션을 기술하고, 반드시 정확해야 하는 상태를 표시하세요. 앵커 사이의 공간은 자연스러운 움직임을 위해 남겨두세요.
하나의 아이디어를 타이밍 기반 스토리 비트로 전환하기
8초 분량의 샷의 경우 유용한 계획은 다음과 같을 수 있습니다: 프레임 0에서 주제를 확립하고, 초기 가이드가 액션을 시작하며, 후기 가이드가 주요 변화를 확인하고, 마지막 프레임에서 안정화됩니다. 24fps 기준 프레임 96은 약 4초에 해당하지만, 항상 그래프에서 실제로 사용되는 프레임 수를 기준으로 계산하세요.
| 타임라인 역할 | 이미지가 고정해야 할 요소 | 프롬프트가 설명해야 할 내용 |
|---|---|---|
| 시작 앵커 | 정체성, 구성, 시작 포즈 | 초기 움직임 및 카메라 동작 |
| 중간 가이드 | 핵심 액션 상태 또는 객체 위치 | 주제가 그 위치에 도달하고 떠나는 방식 |
| 후기 가이드 | 결과, 공개, 또는 변경된 관계 | 감속 및 시각적 연속성 |
| 최종 앵커 | 안정된 종료 구성 | 마지막 움직임, 사운드, 정지 |
호환 가능한 키프레임 이미지 설계하기
화면 비율, 주제 크기, 카메라 높이, 렌즈, 화면 방향, 광원을 일치시켜야 합니다. 넓은 시작 컷과 중간에 극단적인 클로즈업을 사용하면 비현실적인 카메라 이동이 요구될 수 있습니다. 정체성과 타이밍이 먼저 검증된 후에야 더 큰 변화를 도입하세요.

실제 출력 스타일의 키프레임은 하나의 연기처럼 읽혀야 합니다. 여기서 시계공, 앞치마, 작업대, 도구, 황동 소재, 창문에서 들어오는 빛은 모두 일관되게 유지되며, 새만 상태를 변화시킵니다.
모든 참조 자료에 하나의 역할만 부여하기
각 자산은 기능에 따라 이름을 지정하세요: 정체성, 복장, 환경, 제품, 움직임, 시작 프레임, 중간 가이드, 종료 프레임 등. 서로 모순되는 두 가지 목적(예: 다른 배우와 동일한 배우를 동시에 정의)을 하나의 이미지에 요청하지 마세요. 정확한 타임라인 위치보다는 느슨한 시각적 안내가 필요할 경우, 참조-투-비디오 워크플로우를 사용하세요.
MiniMax H3 멀티 키프레임 워크플로우: 단계별 안내
1. 오디오비주얼 잠재 공간 생성
가이드를 추가하기 전에 배송 비율, 해상도, 지속 시간, 최종 프레임 수를 결정하세요. 이미지 VAE는 H3 그래프와 일치해야 하며, 선택된 모든 프레임 인덱스는 잠재 타임라인 내에 포함되어야 합니다. 가이드를 배치한 후 지속 시간을 변경하면 의도한 비트가 이동하거나 무효화될 수 있습니다.
2. 시작 앵커 추가
주제와 환경을 명확히 보여주는 깨끗한 이미지로 시작하세요. 모션 블러, 손이 가려진 경우, 제품이 자른 상태, 실루엣이 읽히지 않는 경우, 또는 이미 불안정해 보이는 포즈는 피하세요. 시작 프레임은 이후 가이드가 따라야 할 기하학적 구조를 설정합니다.
3. 중간 가이드 노드 연결
하나의 MiniMaxH3AddGuide 노드에서 긍정적 조건부 입력을 다음 노드로 전달하세요. 하나의 승인된 이미지를 연결하고 그 frame_idx를 설정하세요. 진단 시점에 그래프가 쉽게 읽힐 수 있도록 시간 순서를 유지하세요.
4. 종료 상태 추가
최종 구성이 정확해야 할 때는 네이티브 마지막 프레임 입력을 사용하세요. 이는 믿을 만한 도착 지점이어야 하며, 제품 프레임, 완료된 제스처 또는 깔끔한 컷을 위해 안정화 시간을 남겨 두세요.
5. 네 개의 별도 프롬프트가 아닌 ‘연결’을 작성하세요
이미지 자체가 외형을 설명합니다. 프롬프트는 그 사이의 움직임을 설명해야 합니다:
승인된 첫 번째 프레임에서 시작하세요. 장인은 양손으로 같은 코발트 색 꽃병을 들어 왼쪽에서 오른쪽으로 안정적으로 걷고, 미리 정해진 나무 선반 위에 올려놓습니다. 동일한 얼굴, 올리브색 셔츠, 점토 자국이 묻은 앞치마, 꽃병 비율, 스튜디오 배치, 그리고 자연광을 유지하세요. 자연스러운 발걸음, 옷의 움직임, 도자기 접촉을 포함한 하나의 연속적인 횡방향 카메라 이동을 사용하세요. 제공된 최종 프레임으로 마무리하고 정지하세요.

실용적인 세 키프레임 테스트: 동작은 바뀌지만, 등장인물, 코발트 색 꽃병, 앞치마, 선반, 창문, 그리고 왼쪽에서 오른쪽으로의 방향은 계속해서 인식 가능합니다.
캐릭터, 환경, 카메라, 오디오의 일관성 유지
포즈와 별개로 정체성 고정
모든 시도에서 하나의 표준 얼굴 참조 이미지를 재사용하세요. 키프레임은 포즈, 표정, 거리만 변경하도록 하고, 나이, 얼굴 구조, 머리카락, 의복은 다시 정의하지 마세요. 시작 프레임, 가장 넓은 화각, 최종 착지 프레임에서 얼굴을 비교하세요.
환경 기하학적 구조 보존
명사의 나열이 아니라 안정적인 관계를 나열하세요: 벤치 뒤의 창문, 카메라 오른쪽의 파란 캐비닛, 테이블 위의 램프. MiniMax H3 환경 일관성 가이드에서는 위치 앵커를 캐릭터 및 동작 참조와 분리하는 방법을 설명합니다.
포스터뿐 아니라 실제 영상도 검토하세요. 유리온실 프레임, 테이블, 의자, 식물, 램프, 주전자, 옷장, 자연광은 동작이 진행됨에 따라 계속해서 인식 가능해야 합니다.
카메라 및 오디오 논리 유지
프롬프트에서 동기화된 변화를 명시하지 않는 한, 화면 내에서 주제는 한 방향으로만 움직이도록 유지하세요. 밀접하게 배치된 가이드 사이에서 회전, 줌, 크레인, 렌즈 교체를 요청하지 마세요. 사운드 타이밍이 중요한 경우, 시각적 이벤트와 동일한 프레임에 짧은 오디오 신호를 고정한 후, 전체 클립에서 대사 재생, 반복되는 충격음, 갑작스러운 공간 음향 변화 등을 확인하세요.

와이드, 클로즈업, 미디엄 뷰도 연주자, 첼로, 의자, 방, 창문 빛, 활 방향이 안정적이라면 여전히 연속적으로 느껴질 수 있습니다.
움직이는 결과물을 통해 손의 리듬, 카메라 연속성, 악기 디테일, 그리고 오디오가 시각적 공연과 정확히 맞물리는지 판단하세요.
ComfyUI 멀티-키프레임 제어 vs Seedance Agent
프레임 단위 제어가 필요할 때 ComfyUI 선택
로컬 ComfyUI은 정확한 프레임 인덱스, 재사용 가능한 그래프, 잠재 공간 접근, 이미지 및 오디오 가이드 실험을 필요로 하는 창작자에게 적합합니다. 단점은 모델, VRAM, 노드 버전, 경로, 메타데이터, 오류 처리를 직접 관리해야 한다는 점입니다.
프로덕션 관리가 필요할 때 Seedance Agent 선택
Seedance Agent는 프로덕션 목표에서 출발합니다. 브리프, 참조 자료, 필수 페이즈, 비율, 승인 기준을 제공하면, 계획 수립, 출력 비교, 섹션 승인, 실패한 부분만 재실행하는 데 활용할 수 있습니다. 재개 가능한 멀티샷 워크플로우에서는 승인된 샷이 내구성 있는 체크포인트가 되는 방식을 설명합니다.
어려운 샷에는 하이브리드 방식 사용
시퀀스 계획과 참조 역할은 Seedance Agent에서 수립하고, 타이밍이 특히 중요한 하나의 샷은 로컬 H3 그래프로 전환한 후, 결과를 검토 및 조립을 위해 다시 반환하세요. 창의적 브리프는 팀원들이 쉽게 읽을 수 있도록 유지되며, 어려운 섹션은 프레임 단위 제어를 그대로 유지합니다. 프로덕션 협업이 노드 관리보다 중요할 때는 Seedance Agent로 시작하세요.
프레임 드리프트, 급격한 형태 변형, 누락된 키프레임 수정
중간 키프레임이 무시됨
가이드가 최종 긍정적 조건부 입력에 연결되어 있고, VAE 입력이 존재하며, frame_idx가 동영상 내 유효한 프레임 범위에 속하는지 확인하세요. 그런 다음 해당 가이드를 인접한 앵커에서 더 멀리 이동시키세요. 너무 가까이 배치된 두 개의 상충되는 목표는 모델이 ‘연결’을 수행할 충분한 시간을 주지 않습니다.
전환 효과가 디졸브(dissolve)처럼 보입니다
시각적 점프를 줄이세요. 정체성, 배경, 렌즈, 조명은 고정된 채 포즈나 객체 위치만 변경하세요. “부드럽게 변환”과 같은 모호한 표현 대신, 눈으로 확인 가능한 물리적 경로(예: 열림, 회전, 이동, 펼침, 붓기, 배치)를 명시하세요.
얼굴 변화가 광각 샷에서 발생합니다
표준 정체성 이미지를 재사용하고, 중간 키프레임을 단순화하세요. 또한 얼굴이 충분히 커서 유의미한 디테일을 전달할 수 있는지 검토하세요. 안정적인 시퀀스를 폐기하지 말고, 대신 H3 원거리 얼굴 수정 워크플로를 사용해 승인된 원거리 샷을 보완하세요.
그래프 비용이 과도해집니다
낮은 드래프트 해상도에서 타이밍과 연속성을 입증하세요. 승인된 결과에 대해서만 업스케일하거나 정제하세요. 생성당 비용이 아니라 승인된 클립당 비용을 추적하고, 재실행 시 한 가지 변수만 변경하여 다음 결과가 학습 자료가 되도록 하세요.
결론
신뢰할 수 있는 MiniMax H3 다중 키프레임 워크플로는 가장 많은 이미지를 추가함으로써 성공하지 않습니다. 호환 가능한 앵커를 소수만 사용하고, 각 참조에 하나의 역할을 부여하며, 상태 간 물리적 움직임을 기술하고, 완전한 오디오비주얼 결과를 검토합니다. 정확한 프레임 배치가 창의적 요구사항일 때는 ComfyUI을 사용하세요. 더 큰 작업 목표가 계획, 승인, 연속성, 선택적 재생성인 경우에는 Seedance Agent를 사용하세요. 먼저 3개 키프레임 테스트를 시작하고, 정제 전에 움직임을 승인한 후, 기존에 통과한 작업을 희생하지 않으면서 시퀀스를 확장하세요.
직접 해볼 준비가 되셨나요?
이 가이드의 단계를 Seedance에서 바로 적용해 프롬프트나 이미지를 몇 분 안에 완성도 높은 영상으로 바꿔보세요.
가입 시 무료 크레딧 제공. 요금제는 월 $20부터.

Seedance 2.5 AI 필름 비용: 렌더링 전에 단편 영화 예산 산정하기
요금제, 촬영 장면 수, 재시도율, 해상도, 오디오, 마무리 작업 등을 기준으로 Seedance 2.5 AI 필름 비용을 신용 포인트를 사용하기 전에 추정하세요.
글 읽기
Seedance 2.5에서 모든 샷 간에 음성을 일관되게 유지하는 방법
깨끗한 오디오 참조, 스피커 잠금(Speaker Lock), 프롬프트 템플릿, 립싱크 확인(Lip-Sync Check), Seedance Agent를 활용해 Seedance 2.5 샷 간에 동일한 음성을 유지하는 방법을 배우세요.
글 읽기
MiniMax H3 재개 가능한 멀티샷 워크플로우 가이드
승인된 샷을 저장하고, 실패 시 재개하며, 하나의 세그먼트만 재롤링하고, 시각적·청각적 연속성을 유지하는 MiniMax H3 워크플로우를 구축합니다.
글 읽기