행사용 AI 아바타: 스크린과 로비 루프 영상을 맡는 AI 사회자
AI 아바타는 행사에서 대본이 정해진 부분의 사회를 볼 수 있습니다. 환영 인사, 안내 사항, 스폰서 감사, 세션 소개를 짧은 16:9 클립으로 만들어 이어 붙이거나 반복 재생합니다.
AI 아바타는 행사에서 대본이 정해진 부분의 사회를 볼 수 있습니다. 환영 인사, 안내 사항, 스폰서 감사 인사, 세션 소개, 그리고 세션 사이에 로비에서 반복 재생하는 루프 영상 같은 부분입니다. Sume에서는 각 부분이 실시간 사회자가 아니라 녹화된 말하는 영상입니다. 아바타는 보낸 스크립트를 말하므로, Q&A나 장소 변경처럼 계획에 없던 일에는 여전히 사람이 나서거나 새로 렌더링해야 합니다.
Sume 관련 사실은 2026-09-28에 확인한 아바타 영상 생성과 Timeline 1.0 문서에서 가져왔으며, 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인했습니다. 행사 전에 티켓을 판매하는 홍보 영상이라면 AI로 행사 홍보 영상을 만드는 방법을 참고하세요.
AI 행사 사회자는 무엇을 진행할 수 있나요?
미리 대본을 쓸 수 있는 것이라면 무엇이든 진행할 수 있으며, 영상 하나에 세그먼트 하나씩입니다.
- 환영 인사와 안내 사항: Wi-Fi, 그날의 일정, 출구, 행동 강령.
- 스폰서 감사 인사와 세션 또는 연사 소개.
- 세션 사이에 재생하는, 일정을 안내하는 로비 루프 영상.
사회자 세그먼트는 어떻게 만드나요?
세그먼트마다 POST /v1/avatar-1.0/talking-video Job을 하나씩 렌더링하세요.
- 사회자는 한 번만 만들거나 스톡 아바타 카탈로그에서 하나 고르고, 모든 화면에 같은 사회자가 나오도록 모든 세그먼트에 같은
avatar_handle을 보내세요. - 스크립트마다 추정 4–60초 안에 들어오게 하고, 각
Idempotency-Key의 이름은 진행 순서에서 그 세그먼트가 들어갈 자리에 따라 지으세요. - 행사장 스크린과 스트리밍 화면용으로
aspect_ratio를16:9로 설정하세요. 기본값은9:16입니다. - 모든 세그먼트에 같은
scene을 보내세요. 무대 프롬프트를 쓰거나, 실제 무대 배경을 찍은 공개 HTTPS 사진을photo장면으로 넣습니다. 영상 하나는 아바타 하나와 공유 장면 하나로 해석됩니다. - 시끄러운 공간을 위해 완성된 세그먼트마다
POST /v1/video-captions로 자막을 넣으세요. 현재 이 Job은 60초보다 긴 소스나 오디오 스트림이 없는 소스를 거부하므로, 세그먼트를 이어 붙이기 전에 자막을 넣으세요.
curl -X POST https://api.sume.com/v1/avatar-1.0/talking-video \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-H "Idempotency-Key: summit-day1-welcome-v1" \
-d '{
"avatar_handle": "event_host",
"script": "Good morning and welcome to day one. Wi-Fi details are on your badge, and the keynote starts at nine in Hall A.",
"scene": { "type": "prompt", "prompt": "Conference stage, blue backdrop, soft spotlights" },
"aspect_ratio": "16:9",
"quality": "plus"
}'세그먼트를 진행 순서대로 잇거나 로비 루프로 만들려면 어떻게 하나요?
AI 아바타 뉴스 앵커가 뉴스 한 편을 만드는 방식처럼, 자막을 넣은 세그먼트를 순서대로 파일당 Timeline 1.0 렌더 하나로 이어 붙이세요. 현재 코드에서 렌더는 각 클립 자체의 소리를 버리므로, 각 세그먼트에서 분리한 음성을 오디오 스파인으로 쓰세요. 스크린용이라면 output.width와 output.height를 1920×1080 같은 16:9 크기로 설정하세요. Timeline은 기본적으로 1080×1920으로 렌더링합니다. 로비용이라면 루프를 한 번 렌더링하고, 화면의 플레이어가 그 파일을 반복 재생하도록 설정하세요.
AI 아바타가 행사를 실시간으로 진행할 수 있나요?
아니요, 할 수 없습니다. 세그먼트 하나하나가 Job입니다. 제출하고, 폴링하고, 완성된 파일을 읽으며, 동기 대기는 최대 30초까지만 기다립니다. 아바타는 현장 소리를 듣거나, 질문을 받거나, 일정 변경에 반응할 수 없습니다. 실시간으로 진행할 순간은 사람이 맡도록 계획하고, 프로그램이 바뀌면 새 세그먼트를 렌더링하세요. 현재 코드에서는 사회자도 영어로만 말합니다. 다른 언어는 AI 아바타가 말할 수 있는 언어에서처럼 TTS 1.0과 Fabric 립싱크를 거칩니다.
어떤 제한이 있나요?
| 구성 요소 | 한도 |
|---|---|
| 세그먼트 하나 | 추정 4–60초, 아바타 하나, 공유 장면 하나. 현재 코드에서는 영어 음성 |
| 형태 | 16:9는 다섯 가지 비율 중 하나(기본값 9:16). 문서에 나온 해상도는 720p |
| 자막 | 세그먼트마다 자막 Job 하나. 현재 최대 60초이며 오디오 스트림 필요 |
| 이어 붙인 파일 | 1–1,800초 스파인, 슬롯 1–200개, 오디오 파트 최대 20개, 모두 Sume 호스팅 |
AI 행사 사회자의 비용은 얼마인가요?
세그먼트는 품질 등급별로 초 단위로 과금되며, 요율은 초당 $0.184(standard), $0.245(plus), $0.55(max), 제품 이미지 없음 기준입니다. 기본 plus 등급에서 세그먼트 5분 분량의 아바타 영상 비용은 $73.50이며, Timeline 렌더는 각각 출력 분당 $0.10로 나와 있습니다. 자막 Job과 오디오 분리는 Job 단위로 가격이 매겨지므로 GET /v1/catalog에서 확인하세요. 모든 항목에는 기본적으로 5.5% 에이전트 수수료가 더해집니다.
출처
관련 글
활용 사례 카테고리의 다른 글
- 의료 분야 AI 아바타: 환자 교육 영상 만들기
의료 분야에서는 AI 아바타를 일반적인 환자 교육에 쓰세요. 의료진이 검토한 짧은 영상에 대기실용 자막을 넣고, 환자 데이터는 담지 않습니다.
- 웹사이트용 AI 아바타: 홈페이지에 넣는 말하는 환영 영상
웹사이트용 AI 아바타는 짧은 진행자 영상입니다. 페이지 형태에 맞춰 자막을 입힌 말하는 클립을 렌더링한 뒤, 포스터 이미지와 함께 MP4를 임베드하세요.
- AI B-roll 생성기: 프롬프트로 컷어웨이 클립 만들기
AI B-roll 생성기는 텍스트 프롬프트나 스틸로 컷어웨이 클립을 만듭니다. 편집본의 화면 비율에 맞추고, 모델이 허용하는 길이를 고르고, 소리는 빼세요.
- 사진으로 AI 생일 축하 영상 만들기: 움직임·음악·문구
사진 몇 장을 짧은 클립으로 움직이고, 새로 만든 연주곡 위에 이어 붙인 뒤, 메시지를 화면에 입혀 AI 생일 영상을 만드세요.
작성자 Sume