Image to Image AI: 내 사진으로 새 이미지 만들기

Image-to-image AI는 텍스트 지시대로 사진을 새 스타일, 배경, 색으로 다시 그립니다. 무엇이 바뀌고 무엇이 유지되는지, 어떻게 실행하는지 정리했습니다.

읽는 시간 5분Sume
전체 글

Image-to-image AI는 입력한 이미지와 텍스트 지시로 새 이미지를 만듭니다. 글만으로 시작하지 않고, 모델이 그 이미지를 레퍼런스로 삼아 다시 그립니다. 스타일을 바꾸거나, 배경을 새로 넣거나, 색을 바꾸거나, 같은 피사체의 변형을 만드는 식입니다. Sume의 이미지 API에서는 text-to-image(텍스트로 이미지 만들기)와 똑같은 POST /v1/images 호출이며, 사진의 URL을 input_references에 넣어 이미지 입력을 받는 모델로 보내면 됩니다.

Sume 관련 사실은 Image API 문서 (영문)와 GET /v1/images/models가 제공하는 모델 카탈로그에서 가져왔으며, 2026-09-28에 확인했습니다. 요청 전체를 필드별로 보려면 레퍼런스 이미지 기반 이미지 생성 API를 참고하세요.

Image-to-image AI는 내 사진으로 무엇을 할 수 있나요?

프롬프트는 무엇을 바꿀지 알려 주고, 레퍼런스는 모델이 작업할 바탕을 제공합니다. 흔히 하는 작업은 다음과 같습니다.

Image-to-image는 text-to-image와 어떻게 다른가요?

Text-to-image는 프롬프트만으로 시작합니다. Image-to-image는 모델이 바탕으로 삼아야 하는 이미지를 하나 이상 더하므로, 결과물은 새로 지어낸 피사체와 구도가 아니라 내 사진의 피사체와 구도에서 출발합니다.

Sume에서 text-to-image 전용 모델은 사진을 400 unsupported_parameter로 거부합니다. 카탈로그가 모델마다 이를 어떻게 표시하는지는 Sume의 이미지 생성 API 모델에서 볼 수 있습니다. 아래 모델은 input_references로 사진을 받으며, 현재 코드에서는 모두 사진을 전용 편집 모드로 보냅니다.

모델은 현재 Sume API 코드 기준, 레퍼런스 한도와 auto 여부는 GET /v1/images/models 디스크립터와 Image API (영문) 기준, 2026-09-28 확인.
모델`model` id요청당 레퍼런스 이미지`aspect_ratio: "auto"`
ChatGPT Image 2.5openai/gpt-image-2.5, openai/gpt-image-2.5-sunburst최대 16장목록에 있음
ChatGPT Image 2openai/gpt-image-2최대 10장목록에 있음
Nano Banana 2google/nano-banana-2최대 10장목록에 있음
Nano Banana Progoogle/nano-banana-pro최대 10장목록에 있음
Seedream 5.0 Litebytedance-seed/seedream-5-lite최대 10장목록에 없음: 목록에 있는 비율을 보내야 함
Seedream 4.5bytedance-seed/seedream-4.5최대 10장목록에 없음: 목록에 있는 비율을 보내야 함

API로 image-to-image를 실행하려면 어떻게 하나요?

사진의 공개 HTTPS URL을 input_references에 넣고, 바꿀 내용을 prompt에 적고, 표에서 모델을 고르세요. 아래 요청은 문서의 예제에 aspect_ratio: "auto"를 더한 것입니다. 문서는 출력이 레퍼런스에 맞도록 image-to-image 호출에 이 값을 권장합니다.

  • localhost, 사설 네트워크, HTTPS가 아닌 URL은 제출 전에 거부되므로, 사진은 공개 HTTPS 주소에 올려 두세요.
  • aspect_ratio를 생략하는 것은 "auto"를 보내는 것과 같지 않습니다. Seedream 모델은 auto를 나열하지 않으므로, 목록에 있는 비율을 지정하세요.
  • 호출은 최대 30초까지 기다립니다. 200 대신 202가 오면 Job이 아직 끝나지 않았다는 뜻입니다. completed, failed, canceled 중 하나가 될 때까지 GET /v1/jobs/{id}/status를 폴링하고, 완료된 경우에만 GET /v1/jobs/{id}/result를 읽으세요.
curl -X POST "https://api.sume.com/v1/images" \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-image-2",
    "prompt": "make this scene look like a watercolor painting",
    "input_references": [
      { "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
    ],
    "aspect_ratio": "auto"
  }'

새 이미지에 내 사진의 디테일이 그대로 남나요?

정확히 그대로 남지는 않습니다. 결과물은 원본 파일에서 한 부분만 고친 것이 아니라 새 이미지이므로, 프롬프트에서 유지하라고 해도 얼굴, 작은 글자, 로고, 세밀한 패턴이 달라질 수 있습니다. 그대로 두어야 할 것을 명시하고, 요청마다 하나만 바꾸고, 결과를 하나하나 원본과 비교하세요. 이를 위한 프롬프트 패턴은 AI 사진 편집 프롬프트에 있습니다.

비용은 얼마이고, 어떤 제한이 있나요?

  • 모델마다 GET /v1/images/models/{model_id}/endpoints의 pricing 항목에 이미지당 요율이 있으며, 여기에 기본 5.5% 에이전트 수수료가 더해집니다. ChatGPT Image 2.5에서는 이 가격을 토큰으로 추정하므로, 출력의 크기와 품질, 보내는 레퍼런스 이미지가 모두 가격을 바꿉니다. 응답의 usage.cost는 청구된 USD 금액이며, 실패하거나 취소된 생성은 과금되지 않습니다. 요율 목록은 AI 이미지 생성 API 비용에 있습니다.
  • 레퍼런스를 보내면 Seedream 4.5는 n 값과 관계없이 호출당 이미지 한 장을 반환합니다(현재 코드 기준).
  • 결과 URL은 Sume가 호스팅하는 서명된 URL이므로, 보관할 이미지는 다운로드하세요.

출처

관련 글

모델 카테고리의 다른 글

모델 글 전체 보기

작성자 Sume