FAQ 영상: AI 아바타로 만드는 방법
FAQ 영상은 자주 묻는 질문 하나에 짧은 클립으로 답합니다. AI 아바타로 세트를 만들 때는 질문마다 스크립트 하나, 렌더 하나를 쓰고 진행자는 끝까지 한 명으로 둡니다.
FAQ 영상은 자주 묻는 질문 하나에 짧은 클립으로 답하는 영상으로, 고객은 도움말 센터, 온보딩 이메일, 고객 지원 답장에서 답을 읽는 대신 볼 수 있습니다. AI 아바타를 쓰면 답변마다 스크립트를 쓰고 질문마다 말하는 영상을 하나씩 렌더링합니다. 진행자는 매번 같고, 촬영은 필요 없습니다.
Sume에서 답변 하나는 최대 60초 길이의 Avatar 1.0 말하는 영상이며, Sume의 현재 추정 방식으로는 약 165단어입니다. 영상은 미리 렌더링한 답변이며, 아바타가 고객에게 실시간으로 답하지는 않습니다. Sume 관련 사실은 2026-09-28에 확인한 아바타 영상 생성과 아바타 영상 프리뷰 문서, Sume API 레퍼런스에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인한 것입니다.
좋은 FAQ 영상의 조건은 무엇인가요?
- 영상 하나에 질문 하나를 담고, 첫 줄에서 그 질문을 말하세요. 그래야 검색이나 채팅 링크로 바로 들어온 사람에게도 클립이 이해됩니다.
- 답을 먼저, 그다음 단계를 말하세요. 다른 질문에 속하는 내용은 빼세요.
- 일 분 미만으로 만드세요. 더 긴 주제는 질문 두 개로 나눕니다.
- 소리를 꺼도 답을 읽을 수 있도록 자막을 넣으세요.
- 세트 전체에서 진행자, 프레이밍, 화면 비율을 똑같이 유지해 하나의 라이브러리처럼 보이게 하세요.
AI 아바타로 FAQ 영상을 어떻게 만드나요?
아바타를 하나 만들고 모든 답변에 그 handle을 재사용하세요. 문서는 앱이 재사용할 간단한 이름인 고정 handle을 권장합니다. 그런 다음 질문마다 POST /v1/avatar-1.0/talking-video를 한 번씩 보내며, 스크립트는 Sume가 4–60초로 추정하는 길이여야 합니다. 단어를 세는 방법은 AI 아바타 영상의 스크립트 길이에서 설명합니다.
영상 하나하나가 Job입니다. 제출하고, 상태를 폴링한 뒤, 결과를 읽으세요. 결과에는 공개 media.sume.com 영상 아티팩트가 포함될 수 있습니다. 답변마다 별도의 Idempotency-Key를 주고, 키는 같은 페이로드에만 재사용하세요.
curl -X POST https://api.sume.com/v1/avatar-1.0/talking-video \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-H "Idempotency-Key: faq-reset-password-v1" \
-d '{
"avatar_handle": "acme_support",
"script": "Forgot your password? On the sign-in page, choose Forgot password, and we will email you a link to set a new one.",
"aspect_ratio": "16:9",
"title": "How do I reset my password?"
}'FAQ 영상에 자막은 어떻게 넣나요?
위 요청에는 넣을 수 없습니다. 현재 코드에서는 레퍼런스에 나와 있는데도 POST /v1/avatar-1.0/talking-video가 captions를 400 invalid_request로 거부합니다. 대신 다음 두 경로 중 하나를 쓰세요.
captions를 넣어 아바타 영상 프리뷰를 만드세요. 프리뷰는 자막 설정을 저장해 두었다가generate-video를 호출할 때만 자막을 입히며, 그 과정에서 첫 프레임도 확인할 수 있습니다.- 완성된 답변 영상에
POST /v1/video-captions로 자막을 넣으세요. 현재 코드에서 이 Job은 60초보다 긴 소스나 오디오 스트림이 없는 소스를 거부합니다.
답변 하나만 어떻게 수정하나요?
그 답변만 다시 렌더링하고 나머지는 그대로 두세요. 대사, 목소리, 장면은 렌더마다 그 안에 들어가므로, 바뀐 답변은 같은 아바타 handle, 새 스크립트, 새 Idempotency-Key로 만드는 새 Job입니다. 그런 다음 도움말 센터 문서나 저장된 답장이 새 URL을 가리키게 하세요.
AI 아바타가 고객 질문에 실시간으로 답할 수 있나요?
Sume 아바타는 할 수 없습니다. 영상은 각각 Job으로 렌더링되며, mode: sync도 최대 30초만 기다립니다. 이 상한은 Job이 아니라 HTTP 대기 시간에 걸립니다. 고객 지원 팀이 할 수 있는 일은 질문이 나오는 곳마다 렌더링된 답변을 링크하고, 제품이 바뀔 때마다 스크립트를 정확하게 유지하는 것입니다.
어떤 제한이 있고, 비용은 얼마인가요?
아바타 생성 비용은 아바타당 $0.95로 한 번만 들고, 답변 영상은 품질 등급별로 초 단위 과금됩니다. 요율은 초당 $0.184(standard), $0.245(plus), $0.55(max), 제품 이미지 없음 기준이며, 기본 등급은 plus입니다. 둘 다 기본적으로 5.5% 에이전트 수수료가 더해지며, 모든 요율은 API 요금에 나와 있습니다. 자막은 비용을 더합니다. 프리뷰에 저장한 자막은 그 영상의 자막 추가 요금이 되고, 단독 자막 Job은 최대 60초 클립마다 고정 금액을 예약하며, 현재 가격은 GET /v1/catalog에서 확인할 수 있습니다.
현재 코드에서 말하는 영상은 영어로만 말합니다. 다른 언어로 된 답변은 AI 아바타는 어떤 언어로 말할 수 있나요?에서 다룹니다.
| 각 FAQ 답변 | |
|---|---|
| 길이 | 추정 4–60초 |
| 진행자 | 영상 하나에 아바타 하나, 세트 전체에 handle 하나를 재사용 |
| 화면 비율 | 1:1, 3:4, 9:16, 4:3, 16:9, 기본값 9:16 |
| 해상도 | 문서에 나온 해상도는 720p |
| 음성 | 영어만 |
| 자막 | 프리뷰를 통해, 또는 오디오가 있는 60초 이하 클립에 자막 Job으로 |
| 결과 | 공개 media.sume.com 영상 아티팩트 |
출처
관련 글
활용 사례 카테고리의 다른 글
- AI로 Slack 커스텀 이모지 만드는 방법(128 KB 미만)
Slack은 128 KB 미만의 투명 배경 정사각형 이미지가 가장 적합하다고 안내합니다. 이미지를 생성해 PNG로 잘라 내고 줄인 뒤 Add Emoji를 클릭하세요.
- AI로 YouTube 채널 예고편 만드는 방법
YouTube 채널 예고편은 아직 구독하지 않은 사람을 맞이하는 영상입니다. 무엇을 말할지, 길이는 얼마로 할지, AI 아바타로 렌더링하는 방법을 정리했습니다.
- AI ASMR 영상 만드는 법: 화면과 소리를 프롬프트로
화면과 함께 소리를 생성하는 영상 모델을 쓰고, 프롬프트에 클로즈업 동작과 그 소리를 설명하세요. 모델, 프롬프트, 길이를 정리했습니다.
- AI 보이스오버 만드는 방법: 대본에서 오디오 파일까지
AI 보이스오버는 대본 쓰기, 목소리 고르기, 음성 생성, 길이 확인, 파일 내려받기의 다섯 단계로 만듭니다. Sume API로 하는 방법을 설명합니다.
작성자 Sume