AI로 30초 광고 영상 만드는 방법
30초 광고는 30초 클립 하나로 만들거나, 보이스오버에 맞춰 샷을 편집해 정확히 30초로 만듭니다. Sume에서는 seedance-2.5와 wan-3.0이 클립 하나로 30초를 만듭니다.

30초 광고를 만들려면 30초 안에 여유 있게 들어가는 대본을 쓰고, 대본에 맞춰 들어갈 샷을 계획하고, 보이스오버와 샷을 만든 다음, 완성된 광고가 정확히 30초가 되도록 편집하세요. Sume에서 AI로 만든다면 최대 30초를 받는 seedance-2.5나 wan-3.0으로 생성한 클립 하나가 광고 전체를 채울 수도 있고, 길이를 초 단위로 정하는 Timeline 1.0 렌더에서 여러 샷을 보이스오버 위에 이어 붙일 수도 있습니다.
Sume 관련 사실은 2026-09-27에 확인한 영상 생성 (영문), Timeline 1.0, 아바타 영상 생성 문서와 Sume API 레퍼런스에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인한 것입니다. 모델별 클립 길이 제한은 AI 영상 생성 API 길이 제한에서 따로 다룹니다.
AI로 30초 광고를 만드는 방법에는 어떤 것이 있나요?
광고가 무엇을 보여 주는지에 따라 경로를 고르세요. 길이는 정수 초 단위이며, 모델마다 받는 길이는 GET /v1/videos/models의 supported_durations에 나와 있습니다. seedance-2.5와 wan-3.0을 제외하면 Sume가 나열하는 모델은 15초 이하에서 멈춥니다.
| 경로 | 30초를 채우는 방법 | Sume 호출 |
|---|---|---|
| 끊김 없는 샷 하나 | seedance-2.5(4–30초) 또는 wan-3.0(2–30초)에 duration: 30 | POST /v1/videos |
| 여러 샷 | 15초 클립 두 개 또는 더 짧은 클립 여러 개를 보이스오버나 음악 트랙 하나 위에 이어 붙임 | POST /v1/videos 다음 POST /v1/timeline-1.0/render |
| 카메라 앞에서 말하는 진행자 | Sume가 약 30초로 추정하는 스크립트로 만든 아바타 영상 하나(4–60초를 받음), 현재 코드에서 아바타는 영어로 말함 | POST /v1/avatar-1.0/talking-video |
광고 길이를 정확히 30초로 맞추려면 어떻게 하나요?
어떤 노출 위치는 고정된 길이만 받습니다. 예를 들어 Amazon은 미국 Prime Video 광고의 길이로 15, 30, 45, 60초를 나열합니다(Prime Video 광고 규격). Timeline 1.0 렌더는 항상 정확히 audio.duration_seconds만큼 재생되므로 이 값을 30으로 설정하세요. 첫 슬롯은 0에서 시작하고, 슬롯들은 스파인을 0.5초 이내의 오차로 덮어야 합니다. 모든 URL은 이전 Sume 출력물처럼 워크스페이스의 media.sume.com 파일이어야 합니다.
현재 렌더의 소리는 클립 자체의 오디오가 아니라 스파인에 선택 사항인 soundtrack을 더한 것입니다. 생성한 클립의 소리를 살리려면 POST /v1/audio-detach로 추출해 스파인으로 쓰세요.
curl -X POST https://api.sume.com/v1/timeline-1.0/render \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-H "Idempotency-Key: spot-30s-001" \
-d '{
"audio": {
"url": "https://media.sume.com/artifacts/artf_demo/voiceover.wav",
"duration_seconds": 30
},
"video": [
{ "source_url": "https://media.sume.com/artifacts/artf_demo/shot-a.mp4", "start": 0, "duration": 15 },
{ "source_url": "https://media.sume.com/artifacts/artf_demo/shot-b.mp4", "start": 15, "duration": 15,
"transition": { "type": "fade", "duration": 0.5 } }
],
"soundtrack": {
"url": "https://media.sume.com/artifacts/artf_demo/music.mp3",
"loop": true, "duck_db": 8, "fade_out_seconds": 2
},
"output": { "width": 1920, "height": 1080 }
}'보이스오버를 30초에 어떻게 맞추나요?
목소리가 속도를 정하므로 대본의 음성부터 만드세요. POST /v1/tts-1.0/generate는 transcript를 읽으며, timestamps.words: true를 주면 현재 코드는 오디오의 duration_seconds와 단어별 시작과 끝도 반환합니다.
- 너무 길거나 짧을 때: 단어를 빼거나 더하거나, 0.6에서 1.5 사이의 배수인
generation_config.speed를 설정하세요. - 한 줄만 다시 녹음해야 할 때:
audio.parts[]는 새 TTS 없이 오디오 조각을 최대 20개까지 틈 없이 이어 주므로, 한 줄만 다시 음성으로 만들고 나머지는 그대로 둘 수 있습니다. - 음악만 쓸 때:
audio.mode: "silence"에 트랙을soundtrack으로 넣고gain_db: 0으로 설정하세요. 배경 음악의 기본값은 −16 dB입니다. 새 트랙을 만든다면 Music Router는 길이를 길이 필드가 아니라 프롬프트("A 30-second track")로 조절합니다.
같은 샷으로 15초 버전은 어떻게 만드나요?
audio.duration_seconds: 15, 15초 보이스오버, 남기고 싶은 슬롯으로 다시 렌더링하세요. 샷은 이미 Sume에 호스팅되어 있으므로 아무것도 두 번 생성되지 않으며, 새 보이스오버와 두 번째 렌더만 과금됩니다. POST /v1/timeline-1.0/plan으로 문서를 하나씩 먼저 검사할 수 있습니다. 이 호출은 과금되지 않으며, Job을 만들지 않고 길이와 과금 대상 분을 반환합니다.
AI로 만든 30초 광고의 비용은 얼마인가요?
단계마다 별도의 Job이며, 각각 기본적으로 5.5% 에이전트 수수료가 더해집니다.
- 샷: 영상 생성은 제출할 때 공급사 정가 × 1.25로 예약되며, 모델별 요율은
GET /v1/videos/models의pricing_skus에 있습니다. - 보이스오버: 1,000자당 $0.0475이며, 공백과 문장 부호도 포함됩니다.
- 음악: 생성 요금은 길이와 관계없이 오디오 1건당 $0.125입니다.
- 렌더: API 요금에 나온 출력 분당 $0.10이므로, 30초 광고든 15초 광고든 일 분이 예약됩니다.
출처
관련 글
활용 사례 카테고리의 다른 글
- AI로 스토리를 영상으로 만들 수 있나요? 네, 샷 단위로
네, AI는 스토리를 짧은 샷의 연속으로 영상화합니다. 샷마다 스틸을 승인해 움직이게 하고, 대사에 목소리를 입힌 뒤, 샷을 순서대로 이으세요.
- 모바일 앱 광고 영상 생성 API: 크리에이터 데모와 엔드 카드
Sume API로 모바일 앱 광고를 만드세요. 앱 스크린샷으로 sume-mobile-app-ugc를 실행하고, 로고 엔드 카드를 더한 뒤, Timeline 1.0으로 두 클립을 이어 붙이면 됩니다.
- 여러 제품 사진을 AI 이미지 한 장으로 합치는 API
여러 제품 사진을 AI 이미지 한 장으로 합치려면 SKU마다 팩샷을 Sume의 sume-editorial-product-set Format에 첨부하거나 POST /v1/images로 보내세요.
- Format으로 제품 사진 한 장에서 마케팅 에셋 만들기
Sume로 제품 사진 한 장에서 마케팅 에셋을 만들려면 에셋마다 카탈로그 Format을 한 번씩 실행해 같은 팩샷을 첨부하고, 실행마다 멱등성 키와 지출 상한을 두세요.
작성자 Sume