텍스트로 AI 만화·애니메이션 영상 만들기: 스타일 정하는 법
프롬프트에 만화나 애니 스타일을 적거나, 그 스타일의 스틸을 먼저 그려 첫 프레임으로 움직이세요. Sume 영상 API에는 스타일 필드가 없습니다.

텍스트로 만화 영상을 만드는 AI는 글로 쓴 설명을 받아, 플랫한 2D 카툰, 애니, 클레이메이션처럼 지정한 스타일의 짧은 애니메이션 클립을 돌려줍니다. Sume의 영상 모델에는 스타일 설정이 없으므로 스타일은 세 곳에서 정해집니다. 프롬프트에 쓴 말, 이미 그 스타일로 그린 첫 프레임, 스타일 레퍼런스 이미지입니다.
아래 내용은 2026-09-28에 확인한 Sume의 영상 생성 (영문), Image API (영문), Models 개요 (영문) 문서에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 API 코드에서 확인한 것입니다. 이미 있는 영상의 스타일을 바꾸려면 클립을 애니메이션으로 바꾸는 법을 참고하세요.
텍스트 프롬프트로 만화 영상을 어떻게 만드나요?
스타일과 동작을 프롬프트 하나에 함께 적어 POST /v1/videos로 보내세요. 요청에는 스타일이나 장르 필드가 없습니다. prompt는 영상을 설명하는 텍스트이고, duration, resolution, aspect_ratio는 별도 필드입니다. Sume 문서는 움직임, 카메라 앵글, 조명, 장면 구성을 자세히 적으라고 권합니다.
코드 없이 하려면 에이전트 탭에서 클립을 설명하세요. 에이전트가 모델을 고르고, 비용을 쓰기 전에 먼저 확인을 받습니다.
- 스타일은 눈에 보이는 그대로 쉬운 말로 적으세요. "flat 2D cartoon, thick outlines, bright colors"(플랫한 2D 카툰, 굵은 외곽선, 밝은 색), "anime, cel shading"(애니, 셀 셰이딩), "claymation, clay texture, stop-motion look"(클레이메이션, 점토 질감, 스톱모션 느낌)처럼 씁니다.
- 동작 하나와 카메라 하나를 더하세요. 누가 어떻게 움직이는지, 카메라가 어디에서 지켜보는지를 적습니다.
grok-imagine-video-1.5를 뺀 모든 Sume 영상 모델은 프롬프트만으로 실행할 수 있습니다. 이 모델에는 첫 프레임이 필요합니다.
curl -X POST https://api.sume.com/v1/videos \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-H "Idempotency-Key: cartoon-fox-001" \
-d '{
"model": "wan-3.0",
"prompt": "Flat 2D cartoon, thick outlines, bright colors: a small orange fox slides down a snowy hill on its belly and tumbles into a snowbank. Side view, the camera follows.",
"aspect_ratio": "16:9",
"resolution": "720p",
"duration": 8
}'만화 스틸을 먼저 그려야 하나요?
캐릭터가 정해진 모습이어야 한다면 그렇습니다. POST /v1/images로 텍스트에서 스틸을 생성하되 이미지 프롬프트에 스타일을 적고, 마음에 드는 것을 골라 POST /v1/videos의 frame_images에 first_frame으로 보내세요. 그러면 클립이 여러분의 그림으로 시작하고, 그 뒤의 움직임은 모델이 생성합니다.
Image API는 Sume에 호스팅된 서명된 결과 URL을 반환하는데, 서명된 URL이나 비공개 URL은 생성 입력으로 거부되므로 고른 스틸은 먼저 공개 HTTPS URL에 올려 두세요. 한 캐릭터로 여러 샷을 만든다면 샷마다 스틸을 만드는 워크플로는 AI로 스토리를 영상으로 만들 수 있나요?에서, 이미 있는 그림은 만화 컷을 움직이는 방법에서 다룹니다.
레퍼런스 이미지로 만화 스타일을 정할 수 있나요?
네, 이미지 레퍼런스를 받는 모델에서는 됩니다. input_references에 type: "image_url"로 이미지를 한 장 이상 보내세요. 문서는 이를 스타일 가이드용 레퍼런스 이미지라고 부르며, 정확한 프레임이 아니라 시각적 가이드로 쓴다고 설명합니다. 그래서 첫 프레임을 고정하는 것이 없고, 클립이 레퍼런스에서 벗어날 수 있습니다. 모델별로 몇 장을 받는지는 Reference-to-Video API에 정리되어 있습니다.
두 방법을 한 요청에 섞지 마세요. 요청에 frame_images도 있으면 프레임이 우선하고, 요청은 이미지로 영상 만들기로 처리됩니다. 현재 코드에서는 이때 레퍼런스가 모델에 전달되지 않습니다. 스타일을 정하는 세 가지 방법을 비교하면 다음과 같습니다.
| 방법 | 보내는 것 | 고정되는 것 | 모델 |
|---|---|---|---|
| 프롬프트에 스타일 적기 | prompt만 | 없음: 스타일은 여러분이 쓴 말에서 나옴 | 첫 프레임이 필요한 grok-imagine-video-1.5를 뺀 전체 |
| 스타일을 입힌 첫 프레임 | frame_images에 first_frame으로 넣은 스틸 | 클립의 첫 프레임 | 전체 |
| 스타일 레퍼런스 | input_references에 type: "image_url"로 넣은 이미지 | 없음: 정확한 프레임이 아닌 시각적 가이드 | kling-3와 grok-imagine-video-1.5를 뺀 전체 |
어떤 제한이 있나요?
- 스타일을 정하는 필드는 없으며, 첫 프레임도 레퍼런스도 모든 프레임에서 스타일이 유지된다고 보장하지 않습니다. 쓰기 전에 클립을 확인하세요.
- 생성 한 번은 짧은 클립 하나이며, 모델에 따라 2–30초입니다. 만화 에피소드 한 편은 여러 클립을 순서대로 이어 붙여 만듭니다.
- 생성된 클립으로는 캐릭터가 말에 맞춰 입을 움직이게 할 수 없습니다. Sume 문서에 따르면 영상 모델은 생성된 음성이나 나중에 입힌 보이스오버에 맞춰 립싱크하지 않습니다.
- 프레임 이미지와 레퍼런스 이미지 URL은 공개 HTTPS여야 합니다.
- 클립마다 모델별로 청구되며, 요율은
GET /v1/videos/models가pricing_skus에 나열합니다.
출처
관련 글
모델 카테고리의 다른 글
- AI 이미지 프롬프트 예시: 템플릿과 복사해 쓸 프롬프트 8개
좋은 AI 이미지 프롬프트는 한두 문장에 피사체, 배경, 스타일, 빛, 구도를 담습니다. 템플릿, 예시 8개, 그리고 설정에 넣을 항목을 정리했습니다.
- AI 사진 편집 프롬프트: 하나만 바꾸고 나머지는 그대로
AI 사진 편집 프롬프트는 바꿀 것을 말하고 유지할 것을 나열합니다. 이 패턴과 함께 배경, 빛, 색, 스타일, 지우기 예시를 담았습니다.
- AI 영상 카메라 무빙 프롬프트: 팬, 달리, 오빗
카메라 무빙은 프롬프트에 샷마다 하나씩, 방향과 속도를 붙여 적으세요. Sume 영상 API에는 카메라 설정이 없습니다. 용어, 예시, 한계를 정리했습니다.
- AI 영상 전환 효과(트랜지션) 만들기: 샷과 샷을 잇는 클립
AI 전환 효과는 한 샷의 마지막 프레임에서 시작해 다음 샷의 첫 프레임에서 끝나는 생성 클립입니다. Sume에서 만드는 방법을 정리했습니다.
작성자 Sume