ComfyUI 군중 비디오 워크플로우: 사람, 동작, 오클루전 제어

E
Emma Chen·9분 읽기·Sep 13, 2026
X에 공유
ComfyUI 군중 비디오 워크플로우: 사람, 동작, 오클루전 제어

AI 개요

군중 비디오에 대한 가장 안전한 ComfyUI 워크플로우는 무엇인가?

승인된 하나의 군중 정지 이미지를 만들고, 주인공을 배경 인물 그룹으로부터 분리한 후, 깊이(depth) 또는 포즈(pose) 가이드를 추가하여 짧은 씬을 생성합니다. 신원, 이동 경로, 오클루전이 안정적으로 유지된 후에만 군중의 동작 강도를 높입니다.

ComfyUI에서 여러 사람을 일관되게 유지하려면 어떻게 해야 하나요?

모든 중요한 인물에게 고유한 역할, 복장 기준점(wardrobe anchor), 화면 영역(screen zone), 행동을 부여하세요. 우선순위 캐릭터에는 참조 자료(reference)를 사용하고, 카메라 이동은 단순하게 유지하며, 전체 클립을 검토하여 캐릭터 교체(swap)나 중복(duplicate) 여부를 확인합니다.

왜 AI 군중 비디오는 융합된 신체와 불필요한 인물을 생성하나요?

군중은 많은 겹치는 주체, 빠른 동작, 작은 얼굴, 불확실한 깊이 정보를 포함합니다. 프롬프트가 계층(layer)이나 이동 경로(path)를 명시하지 않으면, 모델은 오클루전을 새로운 신체나 정체성으로 재해석할 수 있습니다.

군중 장면은 한 번에 생성해야 하나요?

단순하고 약간 움직이는 배경에 대해서만 한 번의 생성을 사용하세요. 더 밀집된 액션의 경우, 먼저 주인공 레이어(hero layer)를 생성하거나 승인한 후, 군중을 두 번째 레이어로 제어하고, 마지막으로 실패한 최소 영역을 합성(composite)하거나 재실행합니다.

군중 장면이 솔로 샷보다 더 쉽게 깨지는 이유

솔로 이미지-투-비디오 씬은 모델에게 하나의 정체성, 하나의 신체, 하나의 주요 동작을 유지하도록 요청합니다. 반면 군중 씬은 이러한 요구 사항을 곱셈으로 증가시키면서 동시에 상호 교차(intersection)까지 추가합니다. 한 사람이 주인공 뒤로 지나가고, 또 다른 사람은 프레임을 벗어나며, 두 팔이 겹쳐지고, 여러 작은 얼굴이 압축을 통해 움직입니다. 모델은 매 프레임마다 각 픽셀이 누구에게 속하는지를 결정해야 합니다. 이것이 설득력 있는 포스터는 여전히 사용 불가능한 클립이 될 수 있는 이유입니다.

실용적인 목표는 “많은 사람을 생성하는 것”이 아니라, 읽기 쉬운 계층 구조(readable hierarchy)를 유지하는 것입니다. 관객이 반드시 인식해야 할 인물, 이야기 전개를 위한 동작을 수행할 인물, 그리고 분위기만 제공할 인물을 미리 결정하세요. 주인공에게는 가장 강력한 참조 자료와 가장 큰 화면 영역을 부여하세요. 주요 조연 인물(extra)은 이름이 붙은 역할(named role)로 취급하세요. 나머지 군중은 스무 명의 개별적으로 묘사된 낯선 사람이 아니라, 공유된 방향, 속도, 깊이를 갖는 그룹으로 간주하세요.

영화 리허설에서는 주인공, 감독, 배경 연기자를 가독성 있는 깊이 계층으로 분리

균일하지 않은 군중이 아니라, 전경의 주인공, 중간 거리의 감독, 배경의 보행자라는 별개의 제어 문제로 각각 검토하세요.

짧은 승인 계약(acceptance contract)으로 시작하세요: 주인공의 얼굴은 인식 가능해야 하며, 신체 중복은 없어야 하고, 전경 이동 경로는 충돌해서는 안 되며, 주요 복장 색상은 할당된 대로 유지되어야 하며, 등장과 퇴장은 각각 한 번만 발생해야 하며, 배경은 주의를 빼앗아서는 안 됩니다. 이를 통해 “군중이 이상해 보인다”는 모호한 평가를 격리 및 재실행이 가능한 구체적인 결함으로 전환합니다.

그래프를 열기 전에 역할 및 영역 계획(role-and-zone plan) 수립

정체성 우선순위 부여

세 가지 수준을 사용하세요. A 우선순위는 주인공 또는 연설자이며, 가장 선명한 이미지 또는 참조 비디오를 받습니다. B 우선순위는 복장과 동작이 중요한 1~3명의 주요 조연 인물입니다. C 우선순위는 분위기 제공용으로, 실루엣, 착석한 관객, 통근자, 혹은 먼 거리의 보행자 등입니다. 모든 인물에게 동일한 조건화 강도(conditioning strength)를 부여하지 마세요. 너무 많은 경쟁적 참조는 오히려 명확성을 저하시킬 수 있습니다.

프롬프트 작성 전에 간결한 매니페스트(manifest)를 작성하세요:

역할 화면 영역 시각적 기준점 동작 반드시 유지되어야 함
주인공 전방-좌측에서 중심까지 녹슨색 코트, 검정 가방 카메라를 향해 걷기 얼굴과 코트는 안정적으로 유지
조연 A 후방-좌측 남색 캡 좌측에서 우측으로 횡단 주인공 뒤로 한 번만 지나감
그룹 B 먼 플랫폼 어두운 오피스 차림 천천히 탑승 배경 크기로 유지

이 표는 제작 관리를 위한 도구일 뿐, 반드시 그대로 복사하여 붙여넣어야 하는 텍스트가 아닙니다. 이는 모델이 추측하기 전에 모순을 해결하도록 강제합니다. 이후 씬에서도 동일한 캐스팅을 유지해야 한다면, 멀티 키프레임 워크플로우(multi-keyframe workflow)에서 시각적 기준점을 승인하고 재사용하는 방법을 설명합니다.

깊이 및 교통 레인(traffic lanes) 설정

씬을 전경, 중간 거리, 배경 영역으로 스케치하세요. 서로 다른 방향을 갖는 두 세 개의 이동 레인을 정의하세요. 첫 번째 테스트 시 여러 전체 신체가 동일한 중심점을 통과하도록 하지 마세요. 좌우 횡단은 무제한 방향으로 흐르는 군중보다 판단하기 쉽습니다. 정적 또는 부드럽게 추적하는 카메라는 신체 동작과 정체성 유지에 더 많은 여유 용량을 남깁니다.

녹슨 코트를 입은 통근자가 시각적 우선순위를 유지하면서, 배경 보행자들이 서로 다른 깊이에서 횡단

일부 인물이 앞쪽을 지나고 다른 인물이 뒤쪽을 지나는 오클루전 테스트를 사용한 후, 각 신체가 깔끔하게 퇴장하는지, 융합되지 않는지 확인하세요.

ComfyUI 군중 비디오 워크플로우 구축

1. 구성 정지 이미지 승인

최종 카메라 높이, 군중 밀도, 복장 배정, 열린 이동 레인을 갖춘 깔끔한 16:9 또는 9:16 이미지를 생성하거나 제공하세요. 애니메이션 전에 중복된 얼굴, 불가능한 손, 교차된 발 등을 수정하세요. 이미지-투-비디오는 승인된 프레임을 애니메이션할 수 있지만, 깨진 군중 레이아웃을 수리하도록 기대해서는 안 됩니다. 직접 호스팅된 테스트의 경우, Seedance 이미지-투-비디오 경로(image-to-video route)를 사용하면 로컬 그래프를 유지하지 않고도 동일한 소스를 평가할 수 있습니다.

2. 씬에 필요한 제어 요소만 추출

예상되는 결함 유형에 따라 가이드를 선택하세요. 깊이 정보는 전경-배경 순서 유지에 도움이 되고, 포즈는 주요 동작을 지원하며, 엣지(edge)는 건축물이나 큰 소도구를 보호할 수 있습니다. 세그멘테이션(segmentation) 또는 마스크(mask)는 주인공을 분위기용 그룹으로부터 분리하는 데 유용합니다. 장면을 가독성 있게 유지하는 데 필요한 최소한의 조합을 사용하세요. 모든 프리프로세서(preprocessor)를 높은 강도로 중첩하면 동작이 경직되거나 제어 간 충돌이 발생할 수 있습니다.움직이는 참조 영상의 경우, 유사한 카메라 앵글과 신체 리듬을 갖춘 깔끔한 구간을 잘라내세요. 추출 전에 해상도와 프레임 속도를 정규화하세요. 인물들이 교차할 때 포즈 트랙이 인접한 인물 간에 급격히 이동하지 않는지 확인하세요. 골격이 뒤바뀌면, 긍정적 프롬프트를 아무리 신중하게 작성해도 동작 자체가 뒤바뀌게 됩니다.

3. 주인공 동작을 군중 동작에서 분리하기

주인공과 소수의 엑스트라만 포함하는 기준선(베이스라인)을 구축하세요. 시드(seed), 모델, 샘플러, 해상도, 프레임 수, 카메라 지시어는 고정된 상태로 유지하세요. 주인공 동작이 성공적으로 완료된 후에야, 분위기용 군중 또는 두 번째 조건부 브랜치를 추가하세요. 워크플로우가 마스킹 또는 컴포지팅을 지원한다면, 주인공과 배경 출력을 충분히 오래 독립적으로 유지하여 둘 다 재생성하지 않고도 하나만 수정할 수 있도록 하세요.

역사 내 보행자들이 교차하는 움직이는 피사체

이 기존 Seedance 라이브러리 클립은 통제된 ComfyUI 벤치마크가 아니라 검사용 예시입니다. 전체 동작을 통해 선두 인물의 신체, 지나가는 보행자, 코트 가장자리, 발, 그리고 가림 현상을 주의 깊게 관찰하세요.

4. 그래프 및 기원 정보 저장하기

워크플로우 JSON, 모델 파일명, 커스텀 노드 버전, 입력 해시, 시드, 해상도, 프레임 수, FPS, 컨트롤 강도, 그리고 승인된 출력을 함께 저장하세요. ComfyUI는 변경된 그래프 영역만 다시 실행할 수 있지만, 승인된 설정이 기록되지 않으면 이러한 이점은 사라집니다. 렌더링 후 큐 실행이 멈출 경우, 창의적 제어를 변경하기 전에 ComfyUI 프리즈 복구 가이드를 참고하세요.

혼란을 일으키지 않고 여러 사람을 프롬프트로 생성하기

프롬프트는 촬영 순서에 따라 작성하세요: 장면 설정 → 우선순위 인물 → 특별히 강조할 엑스트라 → 군중 그룹 → 카메라 → 제외 항목. 중요한 인물은 한 번만 명명하고, 해당 설명어는 일관되게 유지하세요. 배경 인물은 집단적으로 묘사하세요. 예: “어두운 코트를 입은 6명의 통근자가 열린 객차 쪽으로 이동한다”는 표현은, 관련성이 없는 얼굴, 나이, 액세서리들을 길게 나열하는 것보다 훨씬 명확합니다.

유용한 템플릿은 다음과 같습니다:

비가 오는 넓은 승강장, 눈높이 카메라. 녹슬은 코트를 입은 여성이 왼쪽 앞에서 중앙으로 걸어가며 정면을 바라본다. 남색 캡을 쓴 남성이 그녀 뒤에서 왼쪽에서 오른쪽으로 지나간다. 먼쪽 그룹은 정차 중인 기차에 천천히 탑승한다. 부드러운 전진 카메라 트래킹; 자연스러운 걷기 속도; 전경 얼굴 안정; 중복 인물 없음; 충돌 없음; 갑작스러운 등장 없음.

가능한 모든 객체를 막기 위한 부정적 지시어보다는, 실제로 관측된 실패 유형에 대한 부정적 지시어를 사용하세요. “중복된 신체, 융합된 사지, 얼굴 스왑, 순간 이동하는 보행자, 역방향 걷기, 전경으로 갑작스럽게 진입하는 새로운 인물”은 실행 가능한 지시어입니다. 얼굴 문제가 피사체가 작아질 때만 발생한다면, 거리별 얼굴 복구 가이드를 참고해 전반적인 강력한 가이던스보다는 전문적인 진단을 적용하세요.

여섯 명의 무용수가 각각 별도의 레인을 차지하며, 평범한 보행자들은 먼 배경에 머무른다

안무 테스트는 배경 교통량을 종속적으로 유지하면서도 개별 신체와 제스처를 명확히 보존해야 합니다.

소규모 스트레스 계단을 활용해 군중 일관성 테스트하기

최종 페스티벌, 전투, 콘서트 같은 대규모 장면부터 시작하지 마세요. 4단계 스트레스 계단을 사용하세요. 첫 번째 단계: 교차 없이 3명을 애니메이션합니다. 두 번째 단계: 한 명의 엑스트라가 주인공 뒤를 지나가도록 합니다. 세 번째 단계: 전경에서 한 번의 가림 현상을 도입합니다. 네 번째 단계: 먼쪽에 분위기용 그룹을 추가합니다. 지속 시간은 짧게 유지하고, 밀도를 높이기 전에 각 단계를 꼼꼼히 검토하세요.

정상 속도와 프레임 단위로 출력을 평가하세요:

  • 정체성(ID): 우선순위 인물의 얼굴, 머리카락, 의상이 지정된 대로 유지됨.
  • 인물 수: 전경에 새로운 인물이 등장하지 않으며, 필수 인물이 조기에 사라지지 않음.
  • 해부학적 정확성: 겹침 전후로 사지가 올바르게 분리됨.
  • 교통 흐름: 모든 진입, 교차, 퇴장이 지정된 레인을 따름.
  • 심도: 먼 인물은 계속 작게 유지되며 전경으로 급격히 이동하지 않음.
  • 카메라: 카메라 움직임으로 인해 전체 그룹이 미끄러지거나 ‘호흡’하지 않음.
  • 시간적 완성도: 마지막 프레임이 절단 또는 연장이 가능할 정도로 안정됨.

규칙이 위반되는 첫 번째 프레임을 기록하세요. 이 시점은 일반적으로 초기 레이아웃 불량, 포즈 트랙 스왑, 과도한 동작, 약한 정체성 조건부 지시, 또는 군중과 경쟁하는 카메라 움직임 중 어느 하나를 드러냅니다.

전체 장면을 다시 구축하지 않고 실패 해결하기

신체가 융합될 경우, 초기 간격을 넓히고, 교차 경로를 단순화하며, 심도 또는 마스크 분리를 강화하고, 촬영 시간을 단축하세요. 주인공의 정체성이 흐트러질 경우, 프롬프트 내 군중 디테일을 줄이고, 우선순위 참조 영향력을 높이되, 모든 컨트롤 강도를 무조건 높이지는 마세요. 배경이 정지될 경우, 하나의 집단적 동작과 미세한 움직임을 추가하세요. 먼 거리의 각 인물에게 별도의 연기를 부여하지는 마세요.

동작이 떨릴 경우, 포즈 또는 광학적 가이던스를 프레임 단위로 점검하세요. 하나의 결함 있는 트랙을 매끄럽게 보정하거나, 종료 근처에서 컨트롤 강도를 낮추거나, 충돌하는 조건부 지시를 제거하세요. 인물이 화면 가장자리에서 갑자기 등장할 경우, 가장자리 인접 인물을 최소한으로 시작하고, 진입을 명시적으로 지정하세요. 실험마다 성공한 기준선 그래프를 별도로 보관하여, 노드 업데이트로 인해 마지막으로 알려진 양호한 설정이 삭제되지 않도록 하세요.

혼잡한 식료품 시장은 모든 쇼퍼를 주요 캐릭터로 삼지 않으면서도 다양한 심도 계층을 제공한다

밀집된 분위기를 위해, 개별 배경 인물의 연기보다는 심도 순서, 깔끔한 실루엣, 믿을 수 있는 교통 흐름을 먼저 평가하세요.

여러 변형을 생성할 경우, 창의적 생성과 파일 오케스트레이션을 분리하세요. ComfyUI 배치 처리 가이드에서는 결정론적 폴더, 매니페스트, 재시도 방법을 다룹니다. 이 군중 워크플로우는 먼저 하나의 승인된 촬영을 만들어야 하며, 이후 이를 배치 처리할 수 있습니다.

Seedance Agent가 더 간단한 제작 경로가 될 때로컬 ComfyUI 그래프는 정밀한 전처리기, 사용자 정의 마스크, 모델 수준 제어 또는 재현 가능한 실험을 필요로 할 때 유용합니다. 또한 참조 자료, 노드 버전, 큐 상태, 출력 검토, 그리고 부분 재실행에 대한 책임도 함께 부여받게 됩니다. 군중 장면에서는 이러한 협업이 더욱 중요해지는데, 하나의 추가 인물이 거부될 경우 전체적으로 우수한 테이크도 무효화될 수 있기 때문입니다.

Seedance Agent는 그래프 소유권보다 실제 제작 작업이 더 중요한 경우에 유용합니다. 캐스트 우선순위, 참조 자산, 샷 매니페스트, 군중 레인, 지속 시간, 화면 비율, 승인 규칙을 제공하세요. 생성 전에 제안된 샷 계획을 검토하고, 가장 강력한 결과를 승인하며, 실패한 단위만 재실행하세요. 이 방식의 이점은 모든 군중이 완벽해진다는 보장이 아니라, 계획, 생성, 검토, 전달 사이의 명확한 경계를 확립한다는 데 있습니다.

결론

신뢰할 수 있는 ComfyUI 군중 영상 워크플로우는 승인된 구성으로 시작하여, 정체성 우선순위를 할당하고, 깊이 구역과 교통 레인을 분리하며, 필요한 제어만 적용하고, 측정된 스트레스 래더(stress ladder)를 통해 밀도를 증가시킵니다. 전체 클립을 정체성, 인원 수, 해부학적 정확성, 가림(occlusion), 동작, 그리고 실용적인 종료 장면 측면에서 평가한 후, 모든 것을 다시 시작하기보다는 최소한의 실패한 레이어만 수정합니다. 참조 자료, 마스크, 노드 버전, 검토, 재실행 관리가 오히려 더 큰 작업이 되는 경우에는, Seedance Agent로 군중 시퀀스를 계획 및 제작하시되, 로컬 제어가 진정으로 유리한 샷은 여전히 ComfyUI로 처리하세요.

직접 해볼 준비가 되셨나요?

이 가이드의 단계를 Seedance에서 바로 적용해 프롬프트나 이미지를 몇 분 안에 완성도 높은 영상으로 바꿔보세요.

가입 시 무료 크레딧 제공. 요금제는 월 $20부터.