모델

Sume의 이미지 생성 API 모델: 편집·레퍼런스·마스크

Sume의 이미지 생성 API에는 모델이 17개 있습니다. 레퍼런스 이미지로 편집하는 모델, 모델별 레퍼런스 수, 텍스트 전용 모델, 마스크를 받는 모델을 확인하세요.

읽는 시간 5분Sume
전체 글

Sume의 이미지 생성 API인 POST /v1/images는 카탈로그 모델 17개를 하나의 요청 형태로 제공합니다. 그중 13개는 레퍼런스 이미지로 편집할 수 있고, 4개는 텍스트로 이미지 생성만 지원하며, 마스크를 받는 것은 ChatGPT Image 2.5 ID 두 개뿐입니다. 각 모델이 무엇을 받는지는 GET /v1/images/models가 알려 줍니다.

표와 규칙은 Image API 문서 (영문)와 이 카탈로그의 기능 디스크립터에서 가져왔으며, 2026-09-26에 확인했습니다. sume/auto에는 카탈로그 행이 없습니다. Sume가 패밀리를 고르고, 어느 패밀리가 실행됐는지는 공개하지 않습니다.

모델이 이미지를 편집할 수 있는지 어떻게 알 수 있나요?

모델의 카탈로그 행에서 필드 두 개를 확인하세요. 편집할 수 있는 모델은 architecture.input_modalities를 ["text", "image"]로 보고하고, input_references 범위의 최댓값이 영보다 큽니다. 텍스트로 이미지 생성만 하는 모델은 ["text"]와 {"min": 0, "max": 0}을 보고하며, 이 모델에 레퍼런스를 보내면 호출이 400 unsupported_parameter로 실패합니다.

GET /v1/images/models/{model_id}/endpoints의 모델별 레코드에도 같은 supported_parameters가 나옵니다. 문서는 이를 해당 엔드포인트의 확정된 파라미터 집합이라고 부릅니다.

레퍼런스 이미지로 편집할 수 있는 이미지 모델은 무엇인가요?

ChatGPT Image 2.5 ID 두 개는 레퍼런스를 최대 16개까지 받고, 편집할 수 있는 나머지 ID는 모두 최대 10개까지 받습니다. 텍스트 전용 ID는 qwen/qwen-image-max, google/imagen-4-fast, google/imagen-4-ultra, recraft/recraft-v4입니다. 아래 각 행은 카탈로그가 해당 ID에 대해 보고하는 값입니다.

GET /v1/images/models와 Image API (영문) 기준, 2026-09-26 확인.
모델 ID`input_modalities`최대 `input_references``mask_url`
openai/gpt-image-2["text", "image"]10—
openai/gpt-image-2.5["text", "image"]16나열됨
openai/gpt-image-2.5-sunburst["text", "image"]16나열됨
google/nano-banana-2["text", "image"]10—
google/nano-banana-pro["text", "image"]10—
bytedance-seed/seedream-5-lite["text", "image"]10—
bytedance-seed/seedream-4.5["text", "image"]10—
bytedance-seed/seedream-4["text", "image"]10—
x-ai/grok-image["text", "image"]10—
qwen/qwen-image["text", "image"]10—
qwen/qwen-image-max["text"]0—
google/imagen-4-fast["text"]0—
google/imagen-4-ultra["text"]0—
black-forest-labs/flux.2-pro["text", "image"]10—
black-forest-labs/flux.2-flex["text", "image"]10—
ideogram/ideogram-v3["text", "image"]10—
recraft/recraft-v4["text"]0—

레퍼런스 이미지는 몇 장까지, 어떤 형태로 보내나요?

모델의 input_references 최댓값까지 보낼 수 있습니다. 각 항목은 type: "image_url"과 image_url.url을 담은 객체이고, 모든 URL은 공개 HTTPS여야 합니다. localhost, 사설 네트워크, HTTPS가 아닌 URL은 제출 전에 거부됩니다. 모델이 허용하는 수를 넘는 레퍼런스를 담은 요청은 400 오류로 거부됩니다. 전체 편집 호출은 레퍼런스 이미지 기반 이미지 생성 API에서 볼 수 있습니다.

레퍼런스가 들어오면 다르게 동작하는 패밀리가 하나 있습니다. Seedream 4.5는 레퍼런스 최댓값을 10으로 나열하지만, 레퍼런스를 포함한 Seedream 4.5 요청은 이미지를 한 장만 반환하고 output_format을 적용하지 않습니다. 자세한 내용은 Seedream 4.5 API에 있습니다.

마스크 편집을 지원하는 모델은 무엇인가요?

openai/gpt-image-2.5와 openai/gpt-image-2.5-sunburst뿐입니다. 두 ID의 디스크립터에는 ChatGPT Image 2.5 편집용 선택적 공개 HTTPS 마스크인 mask_url과, 값이 auto, transparent, opaque인 background가 나열되어 있습니다. 다른 행에는 두 필드 모두 없으므로, 다른 모델에 둘 중 하나를 보내면 400 unsupported_parameter가 반환됩니다. 마스크 편집 과정은 GPT Image 2.5 API에서 단계별로 설명합니다.

크기, 품질, 이미지 수는 어디에서 다루나요?

이 값들은 서로 다른 기준으로 달라지므로 각각 별도 가이드에서 다룹니다. 화면 비율과 커스텀 크기는 aspect_ratio와 image_size를, 4K, 품질, 이미지 수는 resolution, quality, n을 다룹니다. nano-banana-2 같은 접두어 없는 레거시 ID도 여전히 org/slug 형태의 별칭으로 동작합니다.

이미지 모델의 가격은 어떻게 매겨지나요?

출력 이미지 단위로 매겨집니다. 각 엔드포인트 레코드에는 billable: "output_image"와 unit: "image"가 담긴 pricing 항목이 있으며, 이 항목에는 이미 Sume 마진이 포함되어 있고 기본적으로 5.5% 에이전트 수수료가 더해집니다. ChatGPT Image ID에서는 이 항목이 high 품질, 1024×1024 기준의 참고 금액 하나이며, 요청마다 크기와 품질로 비용을 추정합니다.

실패하거나 취소된 생성은 청구되지 않습니다. API 요금에는 Image Router가 공급사 정가에 Sume 마진을 곱한 요율로 나와 있고, 모델별 요율은 카탈로그에 있습니다.

출처

관련 글

작성자 Sume