Image to Image AI: 내 사진으로 새 이미지 만들기
Image-to-image AI는 텍스트 지시대로 사진을 새 스타일, 배경, 색으로 다시 그립니다. 무엇이 바뀌고 무엇이 유지되는지, 어떻게 실행하는지 정리했습니다.

Image-to-image AI는 입력한 이미지와 텍스트 지시로 새 이미지를 만듭니다. 글만으로 시작하지 않고, 모델이 그 이미지를 레퍼런스로 삼아 다시 그립니다. 스타일을 바꾸거나, 배경을 새로 넣거나, 색을 바꾸거나, 같은 피사체의 변형을 만드는 식입니다. Sume의 이미지 API에서는 text-to-image(텍스트로 이미지 만들기)와 똑같은 POST /v1/images 호출이며, 사진의 URL을 input_references에 넣어 이미지 입력을 받는 모델로 보내면 됩니다.
Sume 관련 사실은 Image API 문서 (영문)와 GET /v1/images/models가 제공하는 모델 카탈로그에서 가져왔으며, 2026-09-28에 확인했습니다. 요청 전체를 필드별로 보려면 레퍼런스 이미지 기반 이미지 생성 API를 참고하세요.
Image-to-image AI는 내 사진으로 무엇을 할 수 있나요?
프롬프트는 무엇을 바꿀지 알려 주고, 레퍼런스는 모델이 작업할 바탕을 제공합니다. 흔히 하는 작업은 다음과 같습니다.
- 스타일 바꾸기: 사진을 그림이나 일러스트로 바꿉니다. 문서에 나온 예제 프롬프트는 "make this scene look like a watercolor painting"입니다. 자세한 내용은 AI로 사진을 그림으로 바꾸는 방법에 있습니다.
- 배경을 교체합니다. 문서의 제품 예제에는 "Keep the product identical; swap the background to a soft daylight studio"라고 적혀 있습니다. AI로 사진 배경 바꾸는 방법을 참고하세요.
- AI로 이미지 속 물체 색상 바꾸는 방법에서처럼 재킷, 자동차, 소파 같은 물체 하나의 색을 바꿉니다.
- 변형 만들기: 같은 피사체를 새로운 포즈, 장소, 계절로 만듭니다.
- AI 이미지 캐릭터 일관성 유지하기에서처럼 매번 같은 레퍼런스를 보내 캐릭터나 제품 하나를 새 장면으로 이어 갑니다.
Image-to-image는 text-to-image와 어떻게 다른가요?
Text-to-image는 프롬프트만으로 시작합니다. Image-to-image는 모델이 바탕으로 삼아야 하는 이미지를 하나 이상 더하므로, 결과물은 새로 지어낸 피사체와 구도가 아니라 내 사진의 피사체와 구도에서 출발합니다.
Sume에서 text-to-image 전용 모델은 사진을 400 unsupported_parameter로 거부합니다. 카탈로그가 모델마다 이를 어떻게 표시하는지는 Sume의 이미지 생성 API 모델에서 볼 수 있습니다. 아래 모델은 input_references로 사진을 받으며, 현재 코드에서는 모두 사진을 전용 편집 모드로 보냅니다.
| 모델 | `model` id | 요청당 레퍼런스 이미지 | `aspect_ratio: "auto"` |
|---|---|---|---|
| ChatGPT Image 2.5 | openai/gpt-image-2.5, openai/gpt-image-2.5-sunburst | 최대 16장 | 목록에 있음 |
| ChatGPT Image 2 | openai/gpt-image-2 | 최대 10장 | 목록에 있음 |
| Nano Banana 2 | google/nano-banana-2 | 최대 10장 | 목록에 있음 |
| Nano Banana Pro | google/nano-banana-pro | 최대 10장 | 목록에 있음 |
| Seedream 5.0 Lite | bytedance-seed/seedream-5-lite | 최대 10장 | 목록에 없음: 목록에 있는 비율을 보내야 함 |
| Seedream 4.5 | bytedance-seed/seedream-4.5 | 최대 10장 | 목록에 없음: 목록에 있는 비율을 보내야 함 |
API로 image-to-image를 실행하려면 어떻게 하나요?
사진의 공개 HTTPS URL을 input_references에 넣고, 바꿀 내용을 prompt에 적고, 표에서 모델을 고르세요. 아래 요청은 문서의 예제에 aspect_ratio: "auto"를 더한 것입니다. 문서는 출력이 레퍼런스에 맞도록 image-to-image 호출에 이 값을 권장합니다.
- localhost, 사설 네트워크, HTTPS가 아닌 URL은 제출 전에 거부되므로, 사진은 공개 HTTPS 주소에 올려 두세요.
aspect_ratio를 생략하는 것은"auto"를 보내는 것과 같지 않습니다. Seedream 모델은auto를 나열하지 않으므로, 목록에 있는 비율을 지정하세요.- 호출은 최대 30초까지 기다립니다.
200대신202가 오면 Job이 아직 끝나지 않았다는 뜻입니다.completed,failed,canceled중 하나가 될 때까지GET /v1/jobs/{id}/status를 폴링하고, 완료된 경우에만GET /v1/jobs/{id}/result를 읽으세요.
curl -X POST "https://api.sume.com/v1/images" \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2",
"prompt": "make this scene look like a watercolor painting",
"input_references": [
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
],
"aspect_ratio": "auto"
}'새 이미지에 내 사진의 디테일이 그대로 남나요?
정확히 그대로 남지는 않습니다. 결과물은 원본 파일에서 한 부분만 고친 것이 아니라 새 이미지이므로, 프롬프트에서 유지하라고 해도 얼굴, 작은 글자, 로고, 세밀한 패턴이 달라질 수 있습니다. 그대로 두어야 할 것을 명시하고, 요청마다 하나만 바꾸고, 결과를 하나하나 원본과 비교하세요. 이를 위한 프롬프트 패턴은 AI 사진 편집 프롬프트에 있습니다.
비용은 얼마이고, 어떤 제한이 있나요?
- 모델마다
GET /v1/images/models/{model_id}/endpoints의pricing항목에 이미지당 요율이 있으며, 여기에 기본 5.5% 에이전트 수수료가 더해집니다. ChatGPT Image 2.5에서는 이 가격을 토큰으로 추정하므로, 출력의 크기와 품질, 보내는 레퍼런스 이미지가 모두 가격을 바꿉니다. 응답의usage.cost는 청구된 USD 금액이며, 실패하거나 취소된 생성은 과금되지 않습니다. 요율 목록은 AI 이미지 생성 API 비용에 있습니다. - 레퍼런스를 보내면 Seedream 4.5는
n값과 관계없이 호출당 이미지 한 장을 반환합니다(현재 코드 기준). - 결과 URL은 Sume가 호스팅하는 서명된 URL이므로, 보관할 이미지는 다운로드하세요.
출처
관련 글
모델 카테고리의 다른 글
- Image-to-Video 프롬프트 예시: 무엇을 써야 하나요?
Image-to-Video 프롬프트는 사진을 다시 설명할 필요가 없습니다. 무엇이 움직이고, 카메라가 무엇을 하고, 무엇이 그대로 있는지 씁니다. 사진 유형별 예시를 담았습니다.
- Kling·Seedance 등 영상 모델, API 하나와 청구서 하나로
네. Sume의 POST /v1/videos는 API 키 하나와 청구서 하나로 Kling, Seedance 등 영상 모델을 호출합니다. Veo는 카탈로그에 없습니다. 요율과 호출 예시를 담았습니다.
- AI로 영상 속 물체 지우는 방법
video-to-video AI 편집 프롬프트에 지울 물체와 그대로 둘 부분을 적으세요. Sume에서 하는 방법, 물체를 바꾸거나 추가하는 법, 대신 블러 처리하는 법을 다룹니다.
- 일본어 텍스트 음성 변환(TTS): 언어를 ja로 지정하기
일본어 TTS는 가나와 한자로 쓴 대본을 보내고 언어를 ja로 지정하세요. 언어를 빼면 Sume가 한자로만 된 문장을 영어로 읽을 수 있습니다.
작성자 Sume