스토리보드를 AI 영상으로: 각 프레임을 샷으로 만들기
스토리보드는 프레임 하나씩 영상으로 만드세요. 스케치를 스틸로 렌더링하고, 각 스틸을 클립의 첫 프레임으로 움직인 뒤, 클립을 순서대로 이으세요.

AI로 스토리보드를 영상으로 만들려면 각 프레임을 샷 하나로 다루세요. 러프 스케치는 먼저 완성된 스틸로 렌더링하거나 완성된 프레임은 그대로 쓴 다음, 짧은 클립의 첫 프레임으로 움직이게 하고 클립들을 스토리보드 순서대로 이으세요. 보드의 순서가 그대로 편집 순서가 되고, 승인한 각 프레임이 해당 샷의 시작 이미지가 됩니다.
아래 단계는 2026-09-27에 확인한 Sume의 Image API (영문), 영상 생성 (영문), Models (영문), Timeline 1.0 문서를 따릅니다.
러프한 스토리보드 스케치를 바로 움직여도 되나요?
샷이 스케치처럼 보여야 할 때만 그렇게 하세요. frame_images의 first_frame은 클립이 시작하는 이미지이므로, 연필 프레임을 넣으면 클립도 연필 그림으로 시작합니다. 완성된 룩을 원하면 이미지로 이미지 만들기로 스케치를 먼저 스틸로 렌더링하세요. 스케치를 input_references의 image_url 항목으로 POST /v1/images에 보내고, 프롬프트에는 완성 스타일을 적습니다.
문서는 이미지로 이미지 만들기 호출에서 결과가 레퍼런스에 맞도록 aspect_ratio: "auto"를 권장하며, input_references 디스크립터가 {"min": 0, "max": 0}인 모델은 레퍼런스를 거부합니다. 스케치의 구도가 유지된다는 보장은 없으므로, 각 스틸을 움직이기 전에 해당 보드 프레임과 비교하세요. 요청 방법은 레퍼런스 이미지 기반 이미지 생성 API에서 다룹니다.
스토리보드 프레임은 각각 어떻게 움직이나요?
승인한 프레임을 POST /v1/videos 요청의 first_frame으로 보내고, 모델의 supported_aspect_ratios 중에서 보드의 프레임 모양에 맞는 값으로 aspect_ratio를 설정한 뒤, 보드에 적힌 액션과 카메라 메모를 프롬프트에 넣으세요. Sume 문서도 대사 없는 샷을 같은 순서, 즉 이미지, 검사, 영상 순서로 처리합니다. 보드에 움직임이 끝나는 지점도 그려져 있다면 그 프레임을 last_frame으로 보내세요. 마지막 프레임에는 첫 프레임이 필요하며, 모델이 supported_frame_images에 둘 다 나열해야 합니다.
프레임 URL은 공개 HTTPS여야 하며, 서명된 URL은 거부됩니다. Image API는 스틸을 서명된 URL로 반환하므로, 승인한 각 스틸을 먼저 공개 HTTPS URL에 호스팅하세요.
{
"model": "seedance-2",
"prompt": "Shot 4: the courier pushes the door open and steps into the rain. Camera tracks left with her, low angle, blue night light.",
"frame_images": [
{
"type": "image_url",
"image_url": { "url": "https://example.com/board/shot-04.png" },
"frame_type": "first_frame"
}
],
"aspect_ratio": "16:9",
"duration": 6
}스토리보드의 순서와 타이밍은 어떻게 유지하나요?
클립은 Timeline 1.0으로 이으세요. Timeline 1.0은 오디오 스파인 하나와 순서가 있는 클립 1–200개를 MP4 하나로 렌더링합니다. 모든 클립은 이미 이 워크스페이스의 media.sume.com 파일이어야 하며, Sume에서 생성한 클립은 이 조건을 만족합니다. 내 프레임 파일은 바로 넣을 수 없고, 공개 API에는 업로드 경로가 문서화되어 있지 않습니다. Timeline 1.0의 필드는 보드와 다음과 같이 대응합니다.
| 보드에서 | Timeline 1.0 필드 | 규칙 |
|---|---|---|
| 프레임 순서 | video[] 슬롯의 순서 | video[0].start는 0이어야 하고, 이후 start는 계속 커져야 함 |
| 샷 길이 | video[].duration | 화면에 최소 0.2초 |
| 컷 또는 전환 효과 | video[].transition | fade, wipeleft, wiperight, slideup, slidedown, dissolve 중 하나, 최대 1초, 첫 슬롯에는 넣을 수 없음 |
| 멈춰 있어야 하는 프레임 | video[].source_url에 넣은 Sume 호스팅 스틸 | 스틸은 정지 화면으로 유지됨 |
| 모양이 다른 샷 | video[].fit | cover(기본값), contain, stretch, blur 중 하나 |
| 사운드트랙 | Sume에 호스팅된 보이스오버나 음악 파일을 넣은 audio.url, 또는 audio.mode: "silence" | 렌더의 소리는 스파인에서 나옴. silence는 오디오 파일 없이 길이만 선언함 |
Sume 에이전트가 스토리보드 전체를 받을 수 있나요?
한 번에 프레임 30장까지 받을 수 있습니다. Agent Completions는 에이전트가 보고 사용할 수 있는 첨부로 이미지를 최대 30장까지 받으며, 브리프는 instruction으로 보내고, 생성 지출에 상한을 두는 generation_spend_cap_usd는 필수입니다. 첨부 형식은 에이전트 API에 이미지 보내기에서 다룹니다.
어떤 제한이 있나요?
- 프레임당 클립 하나이며, 길이는 모델에 따라 2–30초입니다.
- 클립당 프레임은 최대 두 장으로, 첫 프레임과 선택 사항인 마지막 프레임입니다.
- 스케치의 구도나 캐릭터의 모습이 렌더링과 애니메이션을 거쳐도 유지된다는 보장은 없습니다.
- Timeline은 Sume에 호스팅된 미디어만 받습니다. 렌더당 슬롯은 최대 200개, 길이는 최대 1,800초이며, 출력 변의 길이는 256–2160픽셀입니다.
출처
관련 글
활용 사례 카테고리의 다른 글
- 이러닝 내레이션 TTS 녹음: 슬라이드마다 파일 하나
TTS로 이러닝 내레이션을 녹음하려면 슬라이드마다 오디오 파일을 하나씩 늘 같은 음성의 MP3나 WAV로 만들고, 바뀐 슬라이드만 다시 만드세요.
- 언어 학습용 TTS: 느린 속도의 문장별 오디오 만들기
TTS로 언어 학습용 오디오를 만드세요. 목표 언어를 지정하고, 음성을 0.6×까지 늦추고, 단어별 타이밍과 함께 문장마다 클립을 하나씩 받습니다.
- 웹사이트용 TTS: 글마다 오디오 파일 하나 만들기
웹사이트에 TTS를 넣으려면 글마다 서버에서 오디오를 한 번 생성해 파일로 저장하고, 페이지에서는 HTML 오디오 플레이어로 재생하세요.
- 긴 텍스트 TTS·오디오북 만들기: 나눠 합성하고 이어 붙이기
긴 텍스트나 책은 TTS 요청 한도에 맞게 나누고, 모든 조각을 같은 설정으로 합성한 뒤, 오디오를 최대 30분짜리 파일로 이어 붙이세요.
작성자 Sume