AI 북트레일러 만들기: 책 소개글과 표지를 영상으로

AI 북트레일러는 책 소개글과 표지를 짧은 영상으로 만듭니다. 내레이션, 표지로 끝나는 분위기 샷, 음악, 화면에 띄운 제목으로 구성됩니다.

읽는 시간 6분Sume
전체 글

AI 북트레일러 메이커는 이미 있는 책 소개글과 표지로 짧은 홍보 영상을 만듭니다. 내레이션으로 읽는 훅, 스토리를 암시하는 분위기 샷 몇 개, 배경 음악, 화면에 띄운 제목이 들어갑니다. Sume에서는 문서화된 단계를 따라 만듭니다. 텍스트 음성 변환으로 내레이션을 만들고, 이미지로 영상 샷을 만들어 표지로 끝나게 할 수 있으며, 음악 트랙을 생성하고, Timeline 1.0 렌더 한 번으로 샷과 음악을 목소리 아래에 깔고, 자막 Job으로 타이틀 카드를 넣습니다.

이 글의 내용은 2026-09-27에 확인한 Sume의 영상 생성 (영문), Timeline 1.0, Music Router (영문), 영상 캡션 문서와 Sume API 레퍼런스에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인한 것입니다. 내레이션, B-roll, 음악 파이프라인은 얼굴 없는 영상 API에서 다루며, 이 글은 트레일러에서 더해지는 부분을 다룹니다.

AI 북트레일러에는 무엇이 들어가나요?

여러분의 소개글과 표지처럼 권리가 있는 글과 그림만 사용하세요. 생성한 샷은 스토리를 해석한 것이지 책의 삽화가 아닙니다. 구성 요소마다 호출이 하나씩 대응합니다.

영상 생성 (영문), Music Router (영문), Timeline 1.0, 영상 캡션, Sume API 레퍼런스 기준, 2026-09-27 확인.
구성 요소보낼 내용Sume 호출
내레이션소개글을 바탕으로 쓴 짧은 훅을 transcript로POST /v1/tts-1.0/generate
분위기 샷샷마다 움직임, 카메라 앵글, 빛을 설명하는 프롬프트 하나POST /v1/videos
표지 샷분위기 스틸을 first_frame으로, 표지를 last_frame으로POST /v1/videos
음악음악 브리프, 선택적으로 표지를 image_url로POST /v1/music-router/generate
조립내레이션 위에 순서대로 놓은 샷, 그 아래에 깐 음악POST /v1/timeline-1.0/render
타이틀 카드제목, 태그라인, 출간 안내 문구를 시간이 지정된 cues로POST /v1/video-captions

트레일러를 책 표지로 끝내려면 어떻게 하나요?

표지를 frame_images에 last_frame으로 보내고, 표지로 다가가는 움직임을 설명하세요. 현재 코드는 first_frame 없는 last_frame을 거부하므로, 권리가 있는 시작 스틸도 함께 보내세요. 두 이미지 모두 공개 HTTPS URL에 있어야 하며, GET /v1/videos/models의 supported_frame_images에 last_frame이 나열된 모델만 이를 받습니다. 두 프레임 사이는 모두 생성되므로 완성된 클립에서 표지의 글자를 확인하고, 정확한 제목은 텍스트 카드로 화면에 넣으세요. 해당 모델은 Image-to-Video: 첫 프레임과 마지막 프레임에 나와 있습니다.

curl -X POST https://api.sume.com/v1/videos \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: trailer-cover-shot-001" \
  -d '{
    "model": "seedance-2.5",
    "prompt": "Slow push-in through a foggy harbor at night, lantern light, settling on the book cover",
    "frame_images": [
      { "type": "image_url", "image_url": { "url": "https://example.com/harbor.jpg" }, "frame_type": "first_frame" },
      { "type": "image_url", "image_url": { "url": "https://example.com/cover.jpg" }, "frame_type": "last_frame" }
    ],
    "aspect_ratio": "9:16",
    "duration": 6
  }'

내레이션과 음악은 어떻게 만드나요?

내레이션과 조립은 얼굴 없는 영상 API와 같은 방식입니다. TTS 1.0이 훅을 읽으며, 영어가 아닌 책이라면 language를 지정합니다. Timeline 1.0 렌더 한 번이 내레이션 위에 샷을 깔고, 음악은 soundtrack으로 넣으면 duck_db가 목소리 아래로 낮춥니다. Timeline은 워크스페이스의 media.sume.com 파일만 받으므로, 샷마다 URL을 GET /v1/jobs/{id}/result에서 읽으세요.

음악은 Music Router에 분위기, 템포, 악기 두 개에서 네 개, 길이(“A 30-second track”)를 담은 브리프를 보내고, 내레이션 아래에서 재생되므로 “no spoken word”도 넣으세요. 표지는 시각적 컨디셔닝으로 image_url에 넣을 수 있습니다. 길이 필드는 없으므로 받은 트랙의 길이를 확인하세요.

제목과 출간일은 화면에 어떻게 넣나요?

완성된 렌더의 video_url을 cues와 함께 POST /v1/video-captions로 보내세요. 각 큐에는 text와 초 단위의 start, end가 있으며, 큐는 음성 인식을 건너뛰므로 입력한 문구가 그대로 화면에 나옵니다. cues, words, segments, script_text는 함께 쓸 수 없으므로, Job 하나에는 타이틀 카드와 내레이션 자막 중 하나만 담깁니다. 현재 자막 Job은 60초보다 긴 소스를 거부하므로, Sume에서 자막을 넣을 트레일러는 60초 이내로 만드세요.

curl -X POST https://api.sume.com/v1/video-captions \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: trailer-title-cards-001" \
  -d '{
    "video_url": "https://media.sume.com/artifacts/artf_demo/trailer.mp4",
    "cues": [
      { "text": "Some doors stay shut for a reason.", "start": 2, "end": 6 },
      { "text": "The Harbor Keeper", "start": 24, "end": 28 },
      { "text": "Out this October", "start": 28, "end": 30 }
    ]
  }'

AI 북트레일러 비용은 얼마인가요?

단계마다 별도의 Job으로 따로 과금되며, 기본적으로 5.5% 에이전트 수수료가 더해집니다. 내레이션은 1,000자당 $0.0475, 음악 생성은 오디오 1건당 $0.125이고, 렌더는 출력 분당 $0.10로 나와 있습니다. 샷은 제출할 때 공급사 정가 × 1.25로 예약되며, 모델별 요율은 GET /v1/videos/models의 pricing_skus에 있습니다. 자막 Job은 60초 이하 영상에 고정 금액을 예약하며, 금액은 GET /v1/catalog에서 확인하세요. 요율은 API 요금에 나와 있습니다.

출처

관련 글

활용 사례 카테고리의 다른 글

활용 사례 글 전체 보기

작성자 Sume