방송 대기 화면(Starting soon) 만들기: 움직이는 루프 영상

방송 대기 화면(Starting soon)은 방송 캔버스 크기에 맞춘 루프 영상입니다. AI로 움직이는 대기 화면을 만드는 방법을 루프, 문구, 길이 순서로 정리했습니다.

읽는 시간 5분Sume
전체 글

방송 대기 화면은 방송을 시작하기 전에 전체 화면으로 띄워 두는 짧은 루프 영상이나 정지 이미지로, “Starting soon” 같은 문구와 채널 이름을 담습니다. 크기는 방송 캔버스에 맞추고(1080p 방송은 1920×1080, 720p는 1280×720), 클립이 시작한 프레임과 같은 프레임으로 끝나게 해서 루프 지점을 감추세요.

Sume에서는 세 단계로 만듭니다. 배경 이미지로 시작하고 끝나는 이미지로 영상 만들기 클립, 문구를 입히는 자막 Job 하나, 그리고 필요한 시간만큼 클립을 반복하는 Timeline 렌더입니다. 내용은 2026-09-28에 확인한 영상 생성 (영문), 영상 캡션, Timeline 1.0 문서와 Sume API 레퍼런스에서 가져왔으며, 현재 코드라고 밝힌 내용은 Sume의 소스에서 확인한 것입니다.

방송 대기 화면은 어떤 크기여야 하나요?

방송 출력과 같은 크기여야 크기 조정 없이 프레임을 가득 채웁니다. 1080p의 16:9 방송은 1920×1080, 720p는 1280×720입니다. Timeline 1.0은 변마다 256에서 2,160픽셀 사이의 짝수 크기를 모두 렌더링하므로 두 크기 모두 가능하지만, 2560×1440 캔버스는 이 한도보다 넓습니다.

AI로 움직이는 방송 대기 화면을 만들려면 어떻게 하나요?

공개 HTTPS URL에 올린 16:9 배경 이미지에서 시작하세요. 직접 만든 아트여도 되고 생성한 이미지여도 됩니다. 문구는 그림에 넣지 마세요. 문구는 다음 단계에서 직접 쓴 텍스트로 올립니다.

  • 이미지를 first_frame과 last_frame 모두로 POST /v1/videos에 보내고, 시작한 자리로 돌아올 수 있는 잔잔한 움직임을 설명하세요. 현재 카탈로그에서는 grok-imagine-video-1.5를 제외한 모든 모델이 마지막 프레임을 받습니다. 루프를 확인하는 방법은 끊김 없는 AI 루프 영상에서 보여 줍니다.
  • 클립의 소리는 켜 두세요. generate_audio의 기본값은 모델이 지원하는 동작을 따릅니다. 현재 코드에서 자막 Job은 오디오 스트림이 없는 클립을 거부하며, 어차피 Timeline 단계에서 클립 자체의 오디오는 빠집니다.
  • Job이 완료되면 GET /v1/jobs/{id}/result에서 클립의 media.sume.com URL을 읽으세요.
curl -X POST https://api.sume.com/v1/videos \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: starting-soon-loop-v1" \
  -d '{
    "model": "wan-3.0",
    "prompt": "Slow drifting clouds and soft neon light over a city skyline; the camera stays still",
    "frame_images": [
      { "type": "image_url", "image_url": { "url": "https://example.com/starting-soon-bg.png" }, "frame_type": "first_frame" },
      { "type": "image_url", "image_url": { "url": "https://example.com/starting-soon-bg.png" }, "frame_type": "last_frame" }
    ],
    "aspect_ratio": "16:9",
    "resolution": "1080p",
    "duration": 10
  }'

“Starting soon” 문구는 어떻게 넣나요?

POST /v1/video-captions로 입히세요. text에 문구를 넣고 start는 0, end는 클립 길이로 둔 cue 하나면 됩니다. cue는 음성 인식을 건너뛰고 지정한 시각에 문구를 그대로 입힙니다. 문구가 놓일 위치는 영상에 텍스트 넣는 방법에서 다룹니다.

  • 현재 코드에서 기본 스타일인 slam은 문구를 대문자로 쓰고 프레임 전체에 옅은 검은색 틴트를 깝니다.
  • “Starting soon”과 채널 이름은 같은 cue에 넣으세요. 현재 코드에서 slam은 모든 cue를 같은 높이에 그리고 줄바꿈을 무시합니다.
  • design.motion.enter_seconds와 exit_seconds를 0으로 설정해(각각 0–2 범위) 루프 지점에서 문구에 등장·퇴장 애니메이션이 생기지 않게 하세요.

방송 전 대기 시간 내내 틀어 두려면 어떻게 하나요?

자막을 입힌 클립을, 화면을 띄울 시간만큼 긴 Timeline 1.0 슬롯 하나에 넣고 render.pad_mode를 loop로 설정해 반복하세요. 원리는 짧은 클립을 반복(루프)해 영상 길이 늘리는 방법에서 설명합니다. 방송 전 화면에는 음성이 없으므로 audio.mode: "silence"로 설정하고, 길이는 audio.duration_seconds에 최대 1,800초(30분)까지 넣으세요. 기본 프레임이 1080×1920이므로 output은 1920×1080으로 설정하세요.

  • Timeline은 워크스페이스의 media.sume.com 파일만 읽습니다. 완료된 Sume Job에는 그곳의 공개 아티팩트가 포함될 수 있으며, 자막을 입힌 클립도 마찬가지입니다.
  • 음악을 넣으려면 Sume가 호스팅하는 soundtrack을 loop: true, gain_db 0으로 추가하세요. 기본값인 −16 dB는 음성 아래에 까는 배경 음악 수준입니다. AI 로파이(lofi) 영상 생성기는 같은 종류의 루프에 트랙을 붙입니다.
curl -X POST https://api.sume.com/v1/timeline-1.0/render \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: starting-soon-30min-v1" \
  -d '{
    "audio": { "mode": "silence", "duration_seconds": 1800 },
    "video": [
      { "source_url": "https://media.sume.com/artifacts/artf_demo/starting-soon.mp4", "start": 0, "duration": 1800 }
    ],
    "output": { "width": 1920, "height": 1080 },
    "render": { "pad_mode": "loop" }
  }'

대기 화면에 실시간 카운트다운을 띄울 수 있나요?

아니요, 띄울 수 없습니다. 렌더링된 파일은 실제로 언제 방송을 시작할지 알 수 없으므로, 파일 안의 카운트다운은 고정되어 있습니다. 짧은 카운트다운이라면 별도의 클립에 초마다 cue 하나씩, 앞에서처럼 등장·퇴장 시간을 0으로 둔 자막을 입히세요. 자막 Job은 cue를 최대 200개까지 받고 각 cue의 시간은 60초 안이어야 하며, 현재 코드에서는 소스가 오디오 스트림이 있는 60초 이하 영상이어야 합니다. 소리를 켜고 생성한 30초짜리 클립이 그런 예입니다. 카운트다운은 루프 안이 아니라 루프 뒤에 재생하세요. 그렇지 않으면 루프가 돌 때마다 카운트가 처음부터 다시 시작됩니다.

한도와 비용은 어떻게 되나요?

클립은 해당 모델의 공급사 정가 × 1.25로 예약됩니다. Timeline은 출력 분당 $0.10로 나와 있고 분 단위로 올려 예약하므로, 30분짜리 대기 화면이라면 $3.00를 예약합니다. 둘 다 기본적으로 5.5% 에이전트 수수료가 더해집니다. 자막 Job은 최대 60초 클립 하나당 고정 금액이며, 영상 캡션 페이지에 나와 있습니다.

영상 생성 (영문), 영상 캡션, Timeline 1.0, Sume API 레퍼런스 기준, 2026-09-28 확인. 현재 코드나 카탈로그라고 표시한 행은 Sume의 소스에서 확인한 내용입니다.
단계한도
루프 클립 길이모델에 따라 2–30초. seedance-2.5와 wan-3.0은 30초까지, gemini-omni-flash-1.1은 10초까지, 나머지 모델은 모두 최대 15초
마지막 프레임grok-imagine-video-1.5를 제외한 모든 모델(현재 카탈로그)
자막 cueJob당 1–200개. 텍스트 1–400자. 시간 0–60초
자막 소스60초 이하, 오디오 스트림 필요(현재 코드)
Timeline 렌더1–1,800초. 각 변은 256–2,160픽셀의 짝수

출처

관련 글

활용 사례 카테고리의 다른 글

활용 사례 글 전체 보기

작성자 Sume