모델

여러 AI 영상 샷에서 캐릭터 일관성 유지하기: API 입력 3가지

문서화된 Sume API 입력 세 가지로 모든 샷에 같은 캐릭터 소스를 보낼 수 있습니다. 재사용 가능한 Avatar 1.0 아바타, 첫 프레임 스틸 한 장, 또는 이미지 레퍼런스입니다.

읽는 시간 5분Sume
전체 글

Sume API로 여러 AI 영상 샷에 캐릭터 하나를 재사용하려면 모든 요청에 같은 소스를 보내세요. 말하는 샷에는 같은 Avatar 1.0 avatar_handle을, 이미지로 영상 만들기 샷에는 frame_images의 first_frame으로 같은 스틸을, 레퍼런스로 영상 만들기 샷에는 input_references에 같은 이미지를 보냅니다. 문서는 각 입력이 모델에 무엇을 넘기는지 설명하지만, 모든 샷에서 캐릭터가 똑같아 보인다고 보장하는 입력은 문서에 없습니다.

아래 입력은 Sume의 아바타 만들기, 아바타 영상 생성, 영상 생성 (영문), Image API (영문) 문서에 설명되어 있으며, 2026-09-26에 확인했습니다. 여러 장면으로 말하는 영상 하나를 만드는 방법은 다중 장면 아바타 영상 API를 참고하세요.

어떤 입력으로 캐릭터 하나를 여러 샷에 이어 갈 수 있나요?

샷의 종류에 따라 입력을 고르세요. 말하는 샷은 Avatar 1.0으로, 움직임을 생성하는 샷은 POST /v1/videos로 만듭니다.

아바타 영상 생성, 영상 생성 (영문), Image API (영문) 기준, 2026-09-26 확인. 영상 모델별 목록은 GET /v1/videos/models로 확인하세요.
입력엔드포인트문서의 설명한도
avatar_handlePOST /v1/avatar-1.0/talking-video준비된 재사용 가능한 아바타영상당 4–60초, 최종 영상 하나당 해석된 아바타 하나
first_frame을 담은 frame_imagesPOST /v1/videos이미지로 영상 만들기 샷의 첫 프레임모델의 supported_frame_images에 first_frame이 있어야 함
image_url을 담은 input_referencesPOST /v1/videos레퍼런스로 영상 만들기의 시각적 가이드, 정확한 프레임이 아님모델의 supported_input_references에 image_url이 있어야 함
image_url을 담은 input_referencesPOST /v1/images이미지로 이미지 만들기용 레퍼런스 이미지텍스트로 이미지 만들기 전용 모델은 레퍼런스를 거부함

말하는 샷에 아바타 하나를 어떻게 재사용하나요?

먼저 POST /v1/avatar-1.0/generate로 아바타를 한 번 만드세요. 프롬프트, 프로필(props), 또는 레퍼런스 사진(공개 HTTPS image_url을 담은 photo)으로 만들 수 있습니다. 아바타 생성은 Job으로 처리되며, 완료되면 반환된 아바타 handle이나 리소스 ID로 아바타 영상을 생성합니다. 요청 방법은 재사용 가능한 AI 아바타 만들기에서 차례로 설명합니다.

그다음 모든 POST /v1/avatar-1.0/talking-video 요청에 같은 avatar_handle을 보내고, 요청마다 script와 video_inputs 중 정확히 하나를 넣으세요.

  • 각 영상은 Sume가 추정한 길이가 4–60초일 때 접수됩니다.
  • 현재 실행은 최종 영상 하나당 해석된 아바타 하나를 지원하며, 장면 배경이 하나의 공유 장면으로 해석되기를 기대합니다.
  • 사진 장면 레퍼런스 scene: { "type": "photo", "image_url": "https://..." }도 각 영상에 넣을 수 있습니다.

생성하는 모든 샷을 같은 스틸에서 시작하려면 어떻게 하나요?

각 POST /v1/videos 요청에서 캐릭터 스틸을 frame_images의 first_frame으로 보내고, 프롬프트만 바꾸세요. 문서는 frame_images를 이미지로 영상 만들기에 쓰는 첫 프레임 또는 마지막 프레임 이미지로 정의하며, 각 항목의 frame_type은 first_frame 또는 last_frame이어야 합니다. GET /v1/videos/models에서 모델의 supported_frame_images에 first_frame이 있는지 확인하고, 스틸은 공개 HTTPS URL에 올려 두세요. 다음은 연속된 샷 중 두 번째 샷입니다.

curl -X POST "https://api.sume.com/v1/videos" \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: character-shot-02" \
  -d '{
    "model": "seedance-2",
    "prompt": "The character sits down on a park bench and opens a book",
    "frame_images": [
      {
        "type": "image_url",
        "image_url": { "url": "https://example.com/character-still.png" },
        "frame_type": "first_frame"
      }
    ],
    "resolution": "1080p"
  }'

첫 프레임 대신 이미지 레퍼런스는 언제 쓰나요?

샷이 준비한 스틸로 시작하면 안 될 때 input_references를 쓰세요. 문서는 레퍼런스 이미지를 레퍼런스로 영상 만들기를 위한 스타일·콘텐츠 가이드로 설명합니다. 모델은 이를 정확한 프레임이 아니라 시각적 가이드로 사용합니다. supported_input_references에 image_url이 있는 모델만 레퍼런스 이미지를 받고, 모델마다 개수 상한이 있습니다. 모델별 상한은 레퍼런스로 영상 만들기 가이드에서 비교합니다.

두 방식은 한 요청에서 함께 쓸 수 없습니다. 두 필드를 모두 보내면 frame_images가 우선하고, 요청은 이미지로 영상 만들기로 처리되며, 레퍼런스는 버려집니다.

캐릭터 스틸은 처음에 어떻게 만드나요?

Image API인 POST /v1/images로 만듭니다. 프롬프트를 보내거나, 이미지로 이미지 만들기를 하려면 레퍼런스 사진을 input_references의 image_url 항목으로 보내세요. 200 응답은 Sume가 호스팅하는 이미지 URL을 data[].url에 담아 반환합니다. n으로 호출 한 번에 이미지를 최대 10장(모델별 상한은 이보다 낮음)까지 요청할 수 있으므로, 후보를 여러 장 만든 뒤 하나를 고를 수 있습니다.

Image API 문서는 data[].url을 Sume가 호스팅하는 서명된 URL로 설명하며, 영상 생성 문서에는 이 URL을 frame_images에 바로 넘기는 방법이 문서화되어 있지 않습니다. 고른 스틸은 재사용하기 전에 직접 관리하는 공개 HTTPS URL에 올려 두세요.

  • 레퍼런스 URL은 공개 HTTPS여야 합니다.
  • input_references 디스크립터가 {"min": 0, "max": 0}인 모델은 텍스트로 이미지 만들기 전용이며 레퍼런스를 거부합니다.
  • 이미지로 이미지 만들기 호출에서는 문서가 레퍼런스에 맞추도록 aspect_ratio: "auto"를 권장합니다. 이 필드를 생략하는 것과는 다릅니다.

이 입력들로 할 수 없는 것은 무엇인가요?

각 입력은 소스를 재사용할 뿐, 출력을 고정하지는 않습니다. 문서에 나온 다음 한계를 고려해 계획하세요.

  • 시드가 없습니다. seed를 받는 v1 영상 모델이 없고 시드를 지원한다고 밝힌 이미지 모델도 없으므로, 두 API 모두 시드를 받지 않습니다.
  • 현재 실행에서는 최종 말하는 영상 하나당 해석된 아바타가 하나이므로, 화자마다 별도의 영상이 필요합니다.
  • 말하는 영상은 4–60초입니다. 문서는 더 긴 스크립트를 줄이거나 여러 Job으로 나누라고 안내합니다.
  • 샷 사이에서 캐릭터를 똑같이 유지한다고 문서화된 입력은 없으므로, 샷을 이어 붙이기 전에 각 샷을 검토하세요.

출처

관련 글

작성자 Sume