토킹 헤드와 B-roll의 차이는 무엇인가요?

토킹 헤드는 카메라를 보고 말하는 사람의 샷이고, B-roll은 그 사람의 목소리가 계속 나오는 동안 잘라 넣는 영상입니다. 둘이 어떻게 맞물리는지 설명합니다.

읽는 시간 5분Sume
전체 글

토킹 헤드는 카메라를 보고 말하는 사람을 담은 샷이고, B-roll은 그 사람의 목소리가 계속 나오는 동안 잘라 넣는 보조 영상입니다. A-roll이라고도 부르는 토킹 헤드는 말을 전달합니다. B-roll은 그 말이 다루는 대상, 즉 제품, 장소, 단계를 보여 줍니다.

AI 토킹 헤드 영상도 같은 규칙을 따릅니다. 아바타의 목소리는 끊기지 않는 트랙 하나로 흐르고, 그 위에서 화면이 아바타와 B-roll 사이를 오가므로 컷어웨이가 말을 끊는 일이 없습니다. Sume 관련 사실은 2026-09-28에 확인한 아바타 영상 생성, Timeline 1.0, 오디오 분리, Models 개요 (영문) 문서에서 가져왔고, 정의는 일반적인 설명입니다. 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인한 것입니다.

토킹 헤드와 B-roll은 무엇이 다른가요?

하나는 말하는 사람이고, 다른 하나는 말하는 내용입니다. 편집에서는 목소리가 그대로 이어지고 화면이 둘 사이를 오갑니다.

일반적인 정의입니다. 마지막 행은 Models 개요 (영문) 기준이며, 2026-09-28에 확인했습니다.
토킹 헤드(A-roll)B-roll
화면에 나오는 것카메라를 향한 화자제품, 장소, 단계, 디테일
소리시청자가 따라가는 목소리그 위로 화자의 목소리가 계속 재생됨
편집에서의 역할말과 존재감을 전달말이 설명하는 것을 보여 주고 컷을 가림
Sume로 만들기아바타 말하는 영상, 또는 VEED Fabric 1.0으로 립싱크한 스틸이미지·영상 생성: 말이 없는 샷에는 립싱크가 필요 없음

토킹 헤드와 A-roll은 같은 것인가요?

진행자 영상이나 인터뷰 영상에서는 그렇습니다. A-roll은 주된 영상, 곧 이야기를 풀어 가는 샷들이며, 그런 영상에서는 말하는 사람을 담은 샷이 A-roll입니다. B-roll은 잘라 넣는 나머지 전부입니다. 화면 위로 내레이션만 흐르는 영상처럼 화면에 화자가 없는 영상에는 토킹 헤드가 아예 없습니다. 얼굴 없는 영상은 보이스오버와 B-roll만으로 만듭니다.

토킹 헤드와 B-roll은 어떻게 함께 쓰이나요?

목소리는 끊김 없이 이어지고, 화면은 다른 장면으로 넘어갔다가 돌아옵니다. 화자에게 돌아올 때는 입 모양이 그 순간의 말과 맞아야 하므로, 화자의 클립은 목소리와 같은 시점에서 다시 이어집니다. 컷어웨이 중에도 진행자가 보여야 한다면 픽처 인 픽처나 분할 화면으로 둘을 한 화면에 넣으세요.

  • 오프닝, 시청자에게 직접 던지는 질문, 콜투액션에서는 토킹 헤드를 유지하세요.
  • 말이 보여 줄 수 있는 것을 설명할 때 B-roll로 넘어가세요. 기능, 단계, 장소, 숫자 같은 것입니다.
  • 이음매를 가릴 때도 B-roll을 쓰세요. 예를 들어 긴 영상에서 따로 렌더링한 두 클립이 만나는 지점입니다.

AI 토킹 헤드 영상에 B-roll을 어떻게 넣나요?

Sume 아바타 영상은 아바타 하나와 공유 장면 하나로 해석되므로, B-roll을 포함해 화면에 나올 다른 것은 모두 나중에 잘라 넣습니다. 편집은 Timeline 1.0 렌더 하나로 하며, 오디오 분리로 아바타 클립에서 떼어 낸 아바타의 목소리를 오디오 스파인으로 씁니다. 렌더에 들어가는 모든 클립은 Sume에서 생성한 B-roll처럼 이미 워크스페이스에 있는 media.sume.com 파일이어야 합니다. 목소리는 스파인에 두세요. 현재 코드에서 렌더는 스파인과 선택 사항인 사운드트랙만 재생하며, 각 클립 자체의 오디오는 빠집니다. 슬롯 배치와 아바타로 돌아오는 컷의 타이밍은 말하는 아바타 영상에 B-roll 넣기에 나와 있습니다.

출처

관련 글

Sume Avatar 1.0 카테고리의 다른 글

Sume Avatar 1.0 글 전체 보기

작성자 Sume