AI로 30초 광고 영상 만드는 방법

30초 광고는 30초 클립 하나로 만들거나, 보이스오버에 맞춰 샷을 편집해 정확히 30초로 만듭니다. Sume에서는 seedance-2.5와 wan-3.0이 클립 하나로 30초를 만듭니다.

읽는 시간 5분Sume
전체 글

30초 광고를 만들려면 30초 안에 여유 있게 들어가는 대본을 쓰고, 대본에 맞춰 들어갈 샷을 계획하고, 보이스오버와 샷을 만든 다음, 완성된 광고가 정확히 30초가 되도록 편집하세요. Sume에서 AI로 만든다면 최대 30초를 받는 seedance-2.5나 wan-3.0으로 생성한 클립 하나가 광고 전체를 채울 수도 있고, 길이를 초 단위로 정하는 Timeline 1.0 렌더에서 여러 샷을 보이스오버 위에 이어 붙일 수도 있습니다.

Sume 관련 사실은 2026-09-27에 확인한 영상 생성 (영문), Timeline 1.0, 아바타 영상 생성 문서와 Sume API 레퍼런스에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인한 것입니다. 모델별 클립 길이 제한은 AI 영상 생성 API 길이 제한에서 따로 다룹니다.

AI로 30초 광고를 만드는 방법에는 어떤 것이 있나요?

광고가 무엇을 보여 주는지에 따라 경로를 고르세요. 길이는 정수 초 단위이며, 모델마다 받는 길이는 GET /v1/videos/models의 supported_durations에 나와 있습니다. seedance-2.5와 wan-3.0을 제외하면 Sume가 나열하는 모델은 15초 이하에서 멈춥니다.

영상 생성 (영문), Timeline 1.0, 아바타 영상 생성 기준, 2026-09-27 확인.
경로30초를 채우는 방법Sume 호출
끊김 없는 샷 하나seedance-2.5(4–30초) 또는 wan-3.0(2–30초)에 duration: 30POST /v1/videos
여러 샷15초 클립 두 개 또는 더 짧은 클립 여러 개를 보이스오버나 음악 트랙 하나 위에 이어 붙임POST /v1/videos 다음 POST /v1/timeline-1.0/render
카메라 앞에서 말하는 진행자Sume가 약 30초로 추정하는 스크립트로 만든 아바타 영상 하나(4–60초를 받음), 현재 코드에서 아바타는 영어로 말함POST /v1/avatar-1.0/talking-video

광고 길이를 정확히 30초로 맞추려면 어떻게 하나요?

어떤 노출 위치는 고정된 길이만 받습니다. 예를 들어 Amazon은 미국 Prime Video 광고의 길이로 15, 30, 45, 60초를 나열합니다(Prime Video 광고 규격). Timeline 1.0 렌더는 항상 정확히 audio.duration_seconds만큼 재생되므로 이 값을 30으로 설정하세요. 첫 슬롯은 0에서 시작하고, 슬롯들은 스파인을 0.5초 이내의 오차로 덮어야 합니다. 모든 URL은 이전 Sume 출력물처럼 워크스페이스의 media.sume.com 파일이어야 합니다.

현재 렌더의 소리는 클립 자체의 오디오가 아니라 스파인에 선택 사항인 soundtrack을 더한 것입니다. 생성한 클립의 소리를 살리려면 POST /v1/audio-detach로 추출해 스파인으로 쓰세요.

curl -X POST https://api.sume.com/v1/timeline-1.0/render \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: spot-30s-001" \
  -d '{
    "audio": {
      "url": "https://media.sume.com/artifacts/artf_demo/voiceover.wav",
      "duration_seconds": 30
    },
    "video": [
      { "source_url": "https://media.sume.com/artifacts/artf_demo/shot-a.mp4", "start": 0, "duration": 15 },
      { "source_url": "https://media.sume.com/artifacts/artf_demo/shot-b.mp4", "start": 15, "duration": 15,
        "transition": { "type": "fade", "duration": 0.5 } }
    ],
    "soundtrack": {
      "url": "https://media.sume.com/artifacts/artf_demo/music.mp3",
      "loop": true, "duck_db": 8, "fade_out_seconds": 2
    },
    "output": { "width": 1920, "height": 1080 }
  }'

보이스오버를 30초에 어떻게 맞추나요?

목소리가 속도를 정하므로 대본의 음성부터 만드세요. POST /v1/tts-1.0/generate는 transcript를 읽으며, timestamps.words: true를 주면 현재 코드는 오디오의 duration_seconds와 단어별 시작과 끝도 반환합니다.

  • 너무 길거나 짧을 때: 단어를 빼거나 더하거나, 0.6에서 1.5 사이의 배수인 generation_config.speed를 설정하세요.
  • 한 줄만 다시 녹음해야 할 때: audio.parts[]는 새 TTS 없이 오디오 조각을 최대 20개까지 틈 없이 이어 주므로, 한 줄만 다시 음성으로 만들고 나머지는 그대로 둘 수 있습니다.
  • 음악만 쓸 때: audio.mode: "silence"에 트랙을 soundtrack으로 넣고 gain_db: 0으로 설정하세요. 배경 음악의 기본값은 −16 dB입니다. 새 트랙을 만든다면 Music Router는 길이를 길이 필드가 아니라 프롬프트("A 30-second track")로 조절합니다.

같은 샷으로 15초 버전은 어떻게 만드나요?

audio.duration_seconds: 15, 15초 보이스오버, 남기고 싶은 슬롯으로 다시 렌더링하세요. 샷은 이미 Sume에 호스팅되어 있으므로 아무것도 두 번 생성되지 않으며, 새 보이스오버와 두 번째 렌더만 과금됩니다. POST /v1/timeline-1.0/plan으로 문서를 하나씩 먼저 검사할 수 있습니다. 이 호출은 과금되지 않으며, Job을 만들지 않고 길이와 과금 대상 분을 반환합니다.

AI로 만든 30초 광고의 비용은 얼마인가요?

단계마다 별도의 Job이며, 각각 기본적으로 5.5% 에이전트 수수료가 더해집니다.

  • 샷: 영상 생성은 제출할 때 공급사 정가 × 1.25로 예약되며, 모델별 요율은 GET /v1/videos/models의 pricing_skus에 있습니다.
  • 보이스오버: 1,000자당 $0.0475이며, 공백과 문장 부호도 포함됩니다.
  • 음악: 생성 요금은 길이와 관계없이 오디오 1건당 $0.125입니다.
  • 렌더: API 요금에 나온 출력 분당 $0.10이므로, 30초 광고든 15초 광고든 일 분이 예약됩니다.

출처

관련 글

활용 사례 카테고리의 다른 글

활용 사례 글 전체 보기

작성자 Sume