모델

Sume는 어떤 AI 모델을 지원하나요? API별 모델 ID 전체

Sume는 영상 모델 10개, 이미지 모델 17개, Music·TTS Router ID, Avatar 1.0, 립싱크 모델을 지원합니다. 모든 ID를 엔드포인트별로 정리했습니다.

읽는 시간 5분Sume
전체 글

Sume는 POST /v1/videos에서 영상 생성 모델 10개, POST /v1/images에서 이미지 모델 17개, Music Router ID 3개, TTS Router ID 5개를 지원합니다. 여기에 Avatar 1.0과, 스틸 이미지를 움직이는 모델 세 가지인 VEED Fabric 1.0, MiniMax H3 Max Lip Sync, Kling 3.0 Motion Control이 더해집니다.

아래 ID 목록은 2026-09-26에 Sume의 API 계약 코드에서 읽었습니다. 엔드포인트와 규칙은 Models 개요 (영문), 영상 생성 (영문), Image API (영문) 문서와 Sume API 레퍼런스에서 가져왔습니다. 공개 GET /v1/catalog에서도 같은 목록을 확인할 수 있으며, 방법은 마지막에 소개합니다.

API별로 어떤 모델을 호출할 수 있나요?

표에는 API마다 받는 model 값이 나와 있습니다. 모델을 고르는 기능이 없는 API는 고정된 공개 모델 ID를 적었습니다.

Models 개요 (영문)와 API 레퍼런스 기준이며, ID 목록은 2026-09-26에 코드에서 읽었습니다.
API엔드포인트모델 ID
영상 생성POST /v1/videosseedance-2.5, seedance-2-mini, seedance-2, seedance-2-fast, kling-3, wan-3.0, grok-imagine-video-1.5, minimax-h3, minimax-h3-max, gemini-omni-flash-1.1 또는 sume/auto
Image APIPOST /v1/imagesgpt-image-2.5, gpt-image-2.5-sunburst, gpt-image-2, nano-banana-2, nano-banana-pro, seedream-5-lite, seedream-4-5-edit, grok-image, seedream-v4, qwen-image, imagen-4-fast, imagen-4-ultra, flux-2-pro, flux-2-flex, ideogram-v3, recraft-v4, qwen-image-max 또는 sume/auto
Music RouterPOST /v1/music-router/generatesume/music-auto, lyria-3.5, lyria-3-pro
TTS RouterPOST /v1/tts-router/generatesonic-3.6, sonic-3.5, sonic-3, sonic-latest, sonic-preview (sonic-preview는 공급사의 베타 채널)
TTS 1.0POST /v1/tts-1.0/generatesume/tts-1.0 (엔진 선택 없음)
Avatar 1.0 아바타 생성POST /v1/avatar-1.0/generatesume/avatar-1.0/generate
Avatar 1.0 말하는 영상POST /v1/avatar-1.0/talking-videosume/avatar-1.0/talking-video
Avatar Face Swap (베타)POST /v1/models/sume/avatar-face-swap/v1.0/runssume/avatar-face-swap/v1.0
VEED Fabric 1.0POST /v1/veed/fabric-1.0veed/fabric-1.0
MiniMax H3 Max Lip SyncPOST /v1/minimax/h3-max/lip-syncminimax/h3-max/lip-sync
Kling 3.0 Motion ControlPOST /v1/kling/3.0/motion-controlkling/3.0/motion-control
Image 1.0 (곧 은퇴)POST /v1/image-1.0/generatesume/image-1.0
Video 1.0 (곧 은퇴)POST /v1/video-1.0/generatesume/video-1.0
Music 1.0 (은퇴 예정)POST /v1/music-1.0/generatesume/music-1.0

영상·이미지 모델 ID는 어떻게 표기하나요?

영상 ID는 seedance-2처럼 공급사 조직 접두사가 붙지 않은 카탈로그 ID 그대로이며, 레거시 POST /v1/video-router/generate도 같은 ID를 받습니다. sume/auto, 그리고 대신 모델을 고정해야 하는 경우는 OpenRouter 호환 영상 API에서 다룹니다.

Image API는 openai/gpt-image-2.5나 bytedance-seed/seedream-4.5처럼 모델을 org/slug 형식으로 부르며, 표에 있는 접두사 없는 Image Router ID도 해당 org/slug ID의 별칭으로 받습니다. 레거시 /v1/image-router/* 경로는 여전히 동작하지만 지원 중단되었습니다.

아바타 모델과 스틸 이미지 모델은 무엇을 하나요?

아바타 API와 스틸 이미지 API는 하는 일이 서로 다릅니다.

  • Avatar 1.0은 두 단계입니다. 재사용할 아바타를 만든 다음, 스크립트나 다중 장면 video_inputs로 말하는 영상을 생성합니다. quality는 standard, plus(기본값), max 중 하나입니다. 재사용 가능한 AI 아바타 만들기를 참고하세요.
  • Avatar Face Swap(베타)은 준비된 아바타의 얼굴을 공개 소스 영상에 입힙니다.
  • VEED Fabric 1.0은 스틸 이미지(또는 준비된 아바타의 스틸)와 Sume에 호스팅된 오디오로 말하는 클립을 만듭니다. MiniMax H3 Max Lip Sync는 오디오가 5–14.8초일 때 같은 본문을 받습니다. 두 모델은 립싱크 API 가이드에서 비교합니다.
  • Kling 3.0 Motion Control은 직접 제공한 드라이빙 영상의 움직임으로 스틸을 움직이며, 출력 길이는 그 영상을 따릅니다. 모션 컨트롤 API 가이드를 참고하세요.

Sume는 어떤 미디어 도구를 제공하나요?

API에는 음성, 스틸, 클립 조립을 위한 도구도 있습니다. STT, RMBG, 업스케일러 두 개는 Sume API 레퍼런스에 문서화되어 있고, 나머지 도구는 Models 개요 (영문)에서 각 도구의 가이드로 연결됩니다.

  • 음성과 이미지: STT 1.0(POST /v1/stt-1.0/transcribe)은 단어별 타이밍이 담긴 텍스트를 반환하고, RMBG 1.0(POST /v1/rmbg-1.0/remove)은 이미지 배경을 제거하며, Image Upscale 1.0과 Video Upscale 1.0은 스틸과 클립을 업스케일합니다.
  • 클립 준비: 호스팅된 클립 하나를 다루는 영상 검사, 영상 프레임, 영상 트림, 오디오 분리, 영상 필터가 있습니다.
  • 조립: Timeline 1.0은 오디오 스파인과 순서 있는 영상을 MP4 하나로 합치고, 타임라인 합성은 스틸과 영상을 한 프레임에 담으며, 타임라인 오디오는 Sume에 호스팅된 오디오를 이어 붙이거나 나눕니다.
  • 자막과 리서치: 영상 캡션은 기존 공개 영상 URL에 자막을 입히고, 트렌딩 영상은 TikTok 트렌딩 영상 메타데이터를 검색합니다.

은퇴 예정인 모델 API는 무엇인가요?

Video 1.0과 Image 1.0은 곧 은퇴합니다. Video 1.0은 sume/auto로 매핑되고 routing_preset을 무시하며, Image 1.0의 공개 URL은 Image Router Auto의 호환 별칭으로 남습니다. 그러니 새 작업은 POST /v1/videos나 POST /v1/images로 보내세요. 전환 과정은 Video 1.0·Image 1.0 곧 은퇴에서 단계별로 설명합니다. Music 1.0도 은퇴 예정이며, 요청은 Music Router를 거쳐 처리됩니다.

목록을 직접 확인하려면 어떻게 하나요?

GET /v1/catalog는 API 키가 필요 없는 몇 안 되는 /v1 경로 중 하나입니다. 각 항목에는 invoke_url, model_ids, availability가 들어 있고, 유료 기능에는 가능한 경우 USD 가격 메타데이터가 포함됩니다. 영상 ID는 video-router 항목에, 이미지 ID는 image-router 항목에 있습니다.

API별 카탈로그인 GET /v1/videos/models, GET /v1/images/models, GET /v1/music-router/models, GET /v1/tts-router/models는 키가 필요하며, 모델별 세부 정보를 더해 줍니다. 한도가 모델마다 같지 않으므로 모델을 고정하기 전에 여기서 확인하세요. Image API에서는 모델의 supported_parameters에 없는 파라미터를 보내면 400 unsupported_parameter로 거부됩니다.

curl -s https://api.sume.com/v1/catalog \
  | jq '.data[] | { id, invoke_url, model_ids }'

출처

관련 글

작성자 Sume