AI 징글 생성기: 텍스트로 팟캐스트 인트로 만들기

텍스트 브리프로 징글이나 팟캐스트 인트로를 만드세요. 프롬프트로 길이를 요청한 뒤, 오디오 split으로 트랙을 정확한 초에 맞춰 자릅니다.

읽는 시간 5분Sume
전체 글

AI 징글 생성기는 글로 쓴 설명을 짧은 음악으로 바꿉니다. 분위기, 템포, 악기, 길이를 설명하면 음악 모델이 오디오 파일을 돌려줍니다. Sume의 Music Router에는 길이 설정이 없으므로 길이는 프롬프트로 요청하고, 완성된 트랙을 타임라인 오디오의 split으로 정확한 초에 맞춰 자르세요. 요청에 가사 필드가 없으므로 브리프는 연주곡 스팅으로 쓰세요.

단계는 2026-09-27에 확인한 Sume의 Music Router (영문), Music 1.0 (영문), 타임라인 오디오 문서에서, 가격은 API 요금 페이지를 만드는 코드에서 가져왔습니다. 프롬프트 작성법 전반은 AI 음악 프롬프트 예시에서 다룹니다.

징글이나 팟캐스트 인트로 프롬프트는 어떻게 쓰나요?

스팅을 음악 브리프로 쓰세요. 감정, 장르, BPM으로 적은 템포, 조성, 악기 두 개에서 네 개, 구체적으로 짚은 순간 하나, 시대나 프로덕션을 적고, 이어서 길이와 “Instrumental, no vocals.”를 붙입니다. 끝이 어디에 떨어져야 하는지도 적으세요. 나중에 자를 지점은 거기서 찾게 됩니다.

  • 팟캐스트 인트로: “Curious, upbeat jazz-hop intro sting, 94 BPM, B-flat major. Walking upright bass, a dusty drum break, a muted trumpet hook. Two bars of drums, the trumpet hook enters at 0:03, and the band lands on one held chord at 0:08. Warm and close, 2010s production. An 8-second track. Instrumental, no vocals.”
  • 광고용 사운드 로고: “Bright, playful five-note mallet motif, 128 BPM, C major. Marimba, glockenspiel, a soft sub hit under the last note. One rising phrase that ends on a held chord at 0:04. Modern and crisp. A 5-second track. Instrumental, no vocals.”
  • 마무리 멘트 아래에 까는 아웃트로 배경 음악: “Relaxed, friendly lo-fi outro, 86 BPM, F major. Dusty Rhodes, soft brushed drums, round bass. A steady groove that thins out after 0:20. Late-2010s bedroom production. A 30-second track. Instrumental, no vocals, no spoken word.” “no spoken word”는 목소리가 위에 얹힐 때만 추가하세요.

징글의 정확한 길이를 설정할 수 있나요?

음악 요청에서는 할 수 없습니다. duration과 duration_seconds는 거부되며, 길이는 프롬프트로만 조절됩니다(“an 8-second track”, 또는 [0:00-0:08] 같은 구간 표시). Music 1.0 문서는 출력을 최대 몇 분 길이의, 구조를 갖춘 완전한 곡으로 설명하며, 브리프의 세부 사항은 결과를 보장하는 설정값이 아니라 창작 방향이라고 말합니다. 그러니 요청한 길이는 목표로 여기고, 길이를 확정하는 단계는 자르기로 삼으세요.

징글을 정확한 길이로 어떻게 자르나요?

트랙의 URL을 operation: "split", 원하는 구간과 함께 POST /v1/timeline-1.0/audio로 보내세요. 음악 결과는 이미 워크스페이스의 media.sume.com 파일이며, 타임라인 오디오가 요구하는 것도 바로 이 조건입니다. Idempotency-Key도 보내세요. 필수입니다.

  • ranges는 초 단위 { start, end? } 구간을 1–20개 받으며, 구간은 서로 겹쳐도 됩니다. 그래서 Job 하나로 같은 트랙에서 8초 인트로와 5초 버전을 함께 자를 수 있습니다.
  • 결과의 segment마다 자체 audio_url이 있습니다. GET /v1/timeline-1.0/audio/:id는 없으므로 GET /v1/jobs/:id/status와 GET /v1/jobs/:id/result를 폴링하세요.
  • output.format의 기본값은 wav(pcm_s16le, 샘플 단위로 정확)이고, mp3도 쓸 수 있습니다. mp3는 더 작지만 모든 경계에 프라이밍 패딩이 다시 붙습니다. 파일을 다시 이어 붙일 예정이라면 wav를 유지하세요.
  • 타임라인 오디오 문서에는 페이드가 나오지 않고, 현재 코드에서 split은 그대로 잘라 내기만 하므로, 음악이 마무리된 뒤로 끝점을 고르세요.
curl -X POST https://api.sume.com/v1/timeline-1.0/audio \
  -H "Authorization: Bearer $SUME_API_KEY" \
  -H "Content-Type: application/json" \
  -H "Idempotency-Key: intro-sting-cut-001" \
  -d '{
    "operation": "split",
    "url": "https://media.sume.com/artifacts/artf_demo/intro-sting.mp3",
    "ranges": [{ "start": 0, "end": 8 }, { "start": 0, "end": 5 }]
  }'

징글이 브랜드 이름을 말하거나 노래할 수 있나요?

문서화된 기능으로는 할 수 없습니다. 음악 요청에는 가사 필드가 없고, 문서의 예시 브리프는 모두 연주곡이며, result.lyrics는 입력이 아니라 모델이 보고한 메타데이터입니다. 이름을 소리 내어 넣으려면 텍스트 음성 변환으로 음성 멘트를 만드세요. 타임라인 오디오의 concat은 두 파일의 채널 레이아웃이 같을 때만 그 멘트와 스팅을 한 파일로 이어 붙일 수 있으며, 그렇지 않으면 Job이 audio_parts_channel_mismatch로 실패합니다.

AI 징글 비용은 얼마인가요?

Job 두 개가 듭니다. 생성 한 번과 split 한 번이며, 각각 기본적으로 5.5% 에이전트 수수료가 더해집니다. split Job 하나로 여러 컷을 받을 수 있습니다.

Music Router (영문), 타임라인 오디오, API 요금 기준, 2026-09-27 확인.
단계호출가격한도
생성POST /v1/music-router/generate오디오 1건당 $0.125프롬프트 1–5,000자, 길이 필드 없음
자르기POST /v1/timeline-1.0/audio, operation: "split"Job당 $0.01, 문서의 공개 요율구간 1–20개, Sume에 호스팅된 입력, 출력 최대 1,800초

출처

관련 글

활용 사례 카테고리의 다른 글

활용 사례 글 전체 보기

작성자 Sume