행사용 AI 아바타: 스크린과 로비 루프 영상을 맡는 AI 사회자

AI 아바타는 행사에서 대본이 정해진 부분의 사회를 볼 수 있습니다. 환영 인사, 안내 사항, 스폰서 감사, 세션 소개를 짧은 16:9 클립으로 만들어 이어 붙이거나 반복 재생합니다.

읽는 시간 5분Sume
전체 글

AI 아바타는 행사에서 대본이 정해진 부분의 사회를 볼 수 있습니다. 환영 인사, 안내 사항, 스폰서 감사 인사, 세션 소개, 그리고 세션 사이에 로비에서 반복 재생하는 루프 영상 같은 부분입니다. Sume에서는 각 부분이 실시간 사회자가 아니라 녹화된 말하는 영상입니다. 아바타는 보낸 스크립트를 말하므로, Q&A나 장소 변경처럼 계획에 없던 일에는 여전히 사람이 나서거나 새로 렌더링해야 합니다.

Sume 관련 사실은 2026-09-28에 확인한 아바타 영상 생성과 Timeline 1.0 문서에서 가져왔으며, 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인했습니다. 행사 전에 티켓을 판매하는 홍보 영상이라면 AI로 행사 홍보 영상을 만드는 방법을 참고하세요.

AI 행사 사회자는 무엇을 진행할 수 있나요?

미리 대본을 쓸 수 있는 것이라면 무엇이든 진행할 수 있으며, 영상 하나에 세그먼트 하나씩입니다.

  • 환영 인사와 안내 사항: Wi-Fi, 그날의 일정, 출구, 행동 강령.
  • 스폰서 감사 인사와 세션 또는 연사 소개.
  • 세션 사이에 재생하는, 일정을 안내하는 로비 루프 영상.

사회자 세그먼트는 어떻게 만드나요?

세그먼트마다 POST /v1/avatar-1.0/talking-video Job을 하나씩 렌더링하세요.

  • 사회자는 한 번만 만들거나 스톡 아바타 카탈로그에서 하나 고르고, 모든 화면에 같은 사회자가 나오도록 모든 세그먼트에 같은 avatar_handle을 보내세요.
  • 스크립트마다 추정 4–60초 안에 들어오게 하고, 각 Idempotency-Key의 이름은 진행 순서에서 그 세그먼트가 들어갈 자리에 따라 지으세요.
  • 행사장 스크린과 스트리밍 화면용으로 aspect_ratio를 16:9로 설정하세요. 기본값은 9:16입니다.
  • 모든 세그먼트에 같은 scene을 보내세요. 무대 프롬프트를 쓰거나, 실제 무대 배경을 찍은 공개 HTTPS 사진을 photo 장면으로 넣습니다. 영상 하나는 아바타 하나와 공유 장면 하나로 해석됩니다.
  • 시끄러운 공간을 위해 완성된 세그먼트마다 POST /v1/video-captions로 자막을 넣으세요. 현재 이 Job은 60초보다 긴 소스나 오디오 스트림이 없는 소스를 거부하므로, 세그먼트를 이어 붙이기 전에 자막을 넣으세요.
curl -X POST https://api.sume.com/v1/avatar-1.0/talking-video \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: summit-day1-welcome-v1" \
  -d '{
    "avatar_handle": "event_host",
    "script": "Good morning and welcome to day one. Wi-Fi details are on your badge, and the keynote starts at nine in Hall A.",
    "scene": { "type": "prompt", "prompt": "Conference stage, blue backdrop, soft spotlights" },
    "aspect_ratio": "16:9",
    "quality": "plus"
  }'

세그먼트를 진행 순서대로 잇거나 로비 루프로 만들려면 어떻게 하나요?

AI 아바타 뉴스 앵커가 뉴스 한 편을 만드는 방식처럼, 자막을 넣은 세그먼트를 순서대로 파일당 Timeline 1.0 렌더 하나로 이어 붙이세요. 현재 코드에서 렌더는 각 클립 자체의 소리를 버리므로, 각 세그먼트에서 분리한 음성을 오디오 스파인으로 쓰세요. 스크린용이라면 output.width와 output.height를 1920×1080 같은 16:9 크기로 설정하세요. Timeline은 기본적으로 1080×1920으로 렌더링합니다. 로비용이라면 루프를 한 번 렌더링하고, 화면의 플레이어가 그 파일을 반복 재생하도록 설정하세요.

AI 아바타가 행사를 실시간으로 진행할 수 있나요?

아니요, 할 수 없습니다. 세그먼트 하나하나가 Job입니다. 제출하고, 폴링하고, 완성된 파일을 읽으며, 동기 대기는 최대 30초까지만 기다립니다. 아바타는 현장 소리를 듣거나, 질문을 받거나, 일정 변경에 반응할 수 없습니다. 실시간으로 진행할 순간은 사람이 맡도록 계획하고, 프로그램이 바뀌면 새 세그먼트를 렌더링하세요. 현재 코드에서는 사회자도 영어로만 말합니다. 다른 언어는 AI 아바타가 말할 수 있는 언어에서처럼 TTS 1.0과 Fabric 립싱크를 거칩니다.

어떤 제한이 있나요?

아바타 영상 생성, 영상 캡션, Timeline 1.0, Sume의 현재 코드 기준, 2026-09-28 확인.
구성 요소한도
세그먼트 하나추정 4–60초, 아바타 하나, 공유 장면 하나. 현재 코드에서는 영어 음성
형태16:9는 다섯 가지 비율 중 하나(기본값 9:16). 문서에 나온 해상도는 720p
자막세그먼트마다 자막 Job 하나. 현재 최대 60초이며 오디오 스트림 필요
이어 붙인 파일1–1,800초 스파인, 슬롯 1–200개, 오디오 파트 최대 20개, 모두 Sume 호스팅

AI 행사 사회자의 비용은 얼마인가요?

세그먼트는 품질 등급별로 초 단위로 과금되며, 요율은 초당 $0.184(standard), $0.245(plus), $0.55(max), 제품 이미지 없음 기준입니다. 기본 plus 등급에서 세그먼트 5분 분량의 아바타 영상 비용은 $73.50이며, Timeline 렌더는 각각 출력 분당 $0.10로 나와 있습니다. 자막 Job과 오디오 분리는 Job 단위로 가격이 매겨지므로 GET /v1/catalog에서 확인하세요. 모든 항목에는 기본적으로 5.5% 에이전트 수수료가 더해집니다.

출처

관련 글

활용 사례 카테고리의 다른 글

활용 사례 글 전체 보기

작성자 Sume