블로그

모델

Sume의 영상, 이미지, 음성, 음악 엔드포인트에서 쓰는 모델을 다룹니다. 모델 ID, 클립 길이, 해상도, 화면비, 오디오, 레퍼런스, 마이그레이션을 정리했습니다.

먼저 읽을 글: Sume는 어떤 AI 모델을 지원하나요? API별 모델 ID 전체

Seedance 2.5 API: 30초 클립, 해상도, 레퍼런스

Sume의 Seedance 2.5는 seedance-2.5로, 480p, 720p, 1080p의 4–30초 클립을 만듭니다. Seedance ID별로 문서화된 한도, 입력, 과금을 정리했습니다.

Sora 2 API 종료: 영상 생성 호출 마이그레이션

OpenAI는 2026-09-24에 Videos API와 Sora 2 모델을 종료했습니다. 기존 필드와 Sume POST /v1/videos의 대응 관계, 모델 ID를 바꿔야 하는 이유를 다룹니다.

Image-to-Video API: 첫 프레임과 마지막 프레임 지정

first_frame과 선택적 last_frame을 담은 frame_images를 POST /v1/videos로 보내세요. 각 프레임을 받는 Sume 모델, 우선순위, 거부되는 경우를 정리했습니다.

Reference-to-Video API: 이미지·영상·오디오 레퍼런스

POST /v1/videos에 input_references를 보내 레퍼런스 이미지, 영상, 오디오로 클립의 방향을 잡으세요. 유형별로 이를 받는 Sume 영상 모델과 받는 개수를 정리했습니다.

AI 영상 편집 API: 프롬프트로 영상 편집하기(video-to-video)

POST /v1/video-router/generate에 gemini-omni-flash-1.1과 video_url을 보내 기존 클립을 프롬프트로 편집하세요. 편집 모드의 입력, 거부, 비용을 다룹니다.

Sume의 GPT Image 2.5 API: 품질·크기·마스크·레퍼런스

Sume의 POST /v1/images로 ChatGPT Image 2.5를 호출하세요. max까지의 품질, 커스텀 픽셀 크기, 마스크, 최대 16장의 레퍼런스 이미지를 쓸 수 있습니다.

Text-to-Video API 오디오 생성: 소리를 만드는 영상 모델

Sume의 POST /v1/videos는 카탈로그에 generate_audio가 설정된 모델에서 소리를 만듭니다. 모델별 오디오 생성 방식(항상·선택·없음)과 거부되는 값을 정리했습니다.

AI 영상 생성 API 길이 제한: 클립당 최대 30초

Sume에서 30초 클립을 만드는 모델은 seedance-2.5(4–30초)와 wan-3.0(2–30초)이고, 다른 모델은 15초 이하입니다. 모델별 한도, 오류, 더 길게 만드는 법을 정리했습니다.

세로형 9:16 영상 생성 API: 모델별 화면 비율

세로 영상은 POST /v1/videos에 aspect_ratio "9:16"을 보내세요. 9:16, 1:1, 21:9를 지원하는 Sume 모델과 픽셀 크기가 400을 반환하는 이유를 정리했습니다.

4K AI 영상 생성 API: 모델별 해상도, 360p부터 4K까지

Sume에서 4K는 gemini-omni-flash-1.1을 지정해 resolution 4K로 요청하세요. minimax-h3는 2K나 4K로 업스케일합니다. 영상 모델별 해상도와 가격 영향을 다룹니다.

Gemini Omni Flash 1.1 API: 텍스트·이미지·레퍼런스 영상

Sume에서 Gemini Omni Flash 1.1을 gemini-omni-flash-1.1로 호출하세요. 텍스트·이미지·레퍼런스로 360p부터 4K까지 3–10초 클립을 네이티브 오디오와 함께 만듭니다.

MiniMax H3·H3 Max 영상 API: 네이티브 768p·스테레오 오디오

Sume의 MiniMax H3·H3 Max(minimax-h3, minimax-h3-max)는 네이티브 480p·768p(H3 Max는 1080p도)로 5–15초 클립을 만들며, 스테레오 오디오가 항상 들어갑니다.

Sume의 Nano Banana Pro API: 4K 등급·화면 비율·편집

Sume의 POST /v1/images로 Nano Banana Pro나 Nano Banana 2를 호출하세요. 512~4K 해상도 등급, 네이티브 화면 비율, 최대 10장의 레퍼런스 이미지를 쓸 수 있습니다.

립싱크 API: 이미지와 오디오로 말하는 클립 만들기

스틸 이미지와 Sume에 호스팅된 오디오를 VEED Fabric 1.0이나 MiniMax H3 Max Lip Sync로 보내 말하는 클립을 받으세요. 입력, 제한, 초당 요금을 다룹니다.

Sume의 이미지 생성 API 모델: 편집·레퍼런스·마스크

Sume의 이미지 생성 API에는 모델이 17개 있습니다. 레퍼런스 이미지로 편집하는 모델, 모델별 레퍼런스 수, 텍스트 전용 모델, 마스크를 받는 모델을 확인하세요.

AI 이미지 생성 API 화면 비율: 4:5, 커스텀 크기, auto

Sume의 POST /v1/images에 aspect_ratio나 image_size를 보내세요. 4:5를 받는 모델, 커스텀 픽셀 크기를 받는 모델, 편집에서 auto를 보낼 때를 정리했습니다.

Wan 3.0 API: 2–30초 AI 영상, 오디오·프레임·레퍼런스

Sume에서 Wan 3.0을 wan-3.0으로 호출하세요. 프롬프트, 첫 프레임과 마지막 프레임, 또는 이미지·영상·오디오 레퍼런스로 480p, 720p, 1080p의 2–30초 클립을 만듭니다.

Sume의 Seedream 4.5 API: 편집·커스텀 크기·5 Lite

Sume의 POST /v1/images로 Seedream 4.5, 5.0 Lite, 4.0을 호출하세요. 최대 10장의 레퍼런스 이미지로 편집하고 커스텀 픽셀 크기를 지정할 수 있습니다.

4K AI 이미지 생성 API: 해상도, 품질, 이미지 수

Sume의 POST /v1/images에서 4K 등급을 나열하는 모델은 Nano Banana 2와 Pro뿐입니다. 모델별 해상도 등급, 품질 단계, 호출당 이미지 수, 출력 형식을 확인하세요.

Sume는 어떤 AI 모델을 지원하나요? API별 모델 ID 전체

Sume는 영상 모델 10개, 이미지 모델 17개, Music·TTS Router ID, Avatar 1.0, 립싱크 모델을 지원합니다. 모든 ID를 엔드포인트별로 정리했습니다.

모션 컨트롤 API: 드라이빙 영상으로 이미지 움직이기

Sume의 Kling 3.0 Motion Control은 최대 30초 길이의 드라이빙 영상에서 움직임을 가져와 스틸 이미지를 움직입니다. 요청 필드, 제한, 가격을 다룹니다.

텍스트 음성 변환(TTS) API: 아바타 목소리로 음성 생성하기

Sume의 텍스트 음성 변환 API인 POST /v1/tts-1.0/generate는 준비된 아바타의 목소리로 최대 20,000자를 읽으며, 단어별 타임스탬프와 문장별 오디오 조각도 제공합니다.

여러 AI 영상 샷에서 캐릭터 일관성 유지하기: API 입력 3가지

문서화된 Sume API 입력 세 가지로 모든 샷에 같은 캐릭터 소스를 보낼 수 있습니다. 재사용 가능한 Avatar 1.0 아바타, 첫 프레임 스틸 한 장, 또는 이미지 레퍼런스입니다.

음악 생성 API: Sume Music Router와 Lyria 3.5

Sume Music Router는 POST /v1/music-router/generate로 텍스트 프롬프트를 트랙으로 만듭니다. sume/music-auto가 엔진을 고르며, 현재는 Lyria 3.5입니다.

레퍼런스 이미지 기반 이미지 생성 API: POST /v1/images

Sume의 POST /v1/images에 프롬프트와 공개 HTTPS 레퍼런스 이미지를 보내세요. 카탈로그 모델을 고정하거나 sume/auto를 보내면 되고, 모델별 한도는 카탈로그에 나와 있습니다.

TikTok 트렌딩 영상 검색 API: 리서치용 순위 메타데이터

Sume의 POST /v1/trending-videos/search는 브랜드, 제품, 크리에이터, 키워드에 대해 순위가 매겨진 공개 TikTok 영상 메타데이터를 반환합니다. 영상을 내려받지는 않습니다.

Video 1.0·Image 1.0 곧 은퇴: sume/auto로 옮기기

Sume Video 1.0과 Image 1.0은 곧 은퇴하며, 이미 Auto 경로의 별칭으로 동작합니다. 새 연동은 sume/auto로 /v1/videos나 /v1/images를 호출합니다.

OpenRouter 호환 영상 생성 API: sume/auto 또는 고정 모델

Sume의 POST /v1/videos는 OpenRouter 영상 생성 API를 필드 단위로 따릅니다. sume/auto가 모델을 고르게 하거나 seedance-2.5 같은 카탈로그 ID로 고정하세요.