AI로 만화 컷을 움직일 수 있나요? 네, 컷마다 클립 하나
네, 만화 컷 하나하나를 짧은 AI 클립의 첫 프레임으로 쓰고, 타임라인에서 클립을 읽는 순서대로 이어 소리가 있는 모션 코믹을 만들 수 있습니다.

네, AI로 만화 컷을 움직일 수 있으며, 한 번에 한 컷씩 작업합니다. 완성된 컷 하나하나가 이미지로 영상 만들기로 생성하는 짧은 클립의 첫 프레임이 되고, 이 클립들을 읽는 순서대로 이어 전환 효과와 소리가 있는 모션 코믹을 만듭니다. 컷은 클립의 시작 이미지이며, 그 뒤에 무엇이 움직일지는 프롬프트와 모델에 달려 있습니다.
필드와 한도는 2026-09-27에 확인한 Sume의 영상 생성 (영문), Timeline 1.0 문서와 GET /v1/videos/models가 제공하는 모델 카탈로그에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 API 코드에서 확인한 것입니다.
만화 컷 하나는 어떻게 움직이나요?
POST /v1/videos의 frame_images에 컷을 first_frame으로 보내고, 프롬프트에 움직임을 설명하세요. 무엇이 움직이는지, 카메라가 어떻게 움직이는지, 빛은 어떤지를 적습니다. 컷 이미지는 공개 HTTPS URL에 있어야 합니다. 클립 길이는 모델에 따라 2–30초이며, 모델별 supported_durations는 GET /v1/videos/models에 나옵니다.
{
"model": "wan-3.0",
"prompt": "Her hair and scarf lift in a strong wind, speed lines streak past, slow push-in on her face",
"frame_images": [
{
"type": "image_url",
"image_url": { "url": "https://example.com/manga/ch3-panel-07.png" },
"frame_type": "first_frame"
}
],
"aspect_ratio": "3:4",
"duration": 4
}AI 영상 모델은 어떤 모양의 컷을 움직일 수 있나요?
모델이 supported_aspect_ratios에 나열한 모양입니다. aspect_ratio는 그 목록에 있는 값이어야 하기 때문입니다. 2:3이나 4:5를 나열한 모델은 없으므로, 세로로 긴 컷은 3:4나 9:16, 가로로 긴 컷은 16:9나 21:9로 만들어야 합니다. 문서는 모양이 aspect_ratio와 다른 첫 프레임을 모델이 어떻게 처리하는지 밝히지 않으므로, 각 컷을 보내기 전에 목록에 있는 비율로 자르거나 여백을 채우고, aspect_ratio도 그에 맞게 설정하세요.
| 모델 | 화면 비율 |
|---|---|
| Seedance 2.x | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 |
minimax-h3, minimax-h3-max | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 |
wan-3.0 | 16:9, 4:3, 1:1, 3:4, 9:16 |
kling-3 | 16:9, 9:16, 1:1 |
gemini-omni-flash-1.1 | 16:9, 9:16 |
grok-imagine-video-1.5 | aspect_ratio를 받지 않음 |
여러 컷에서 캐릭터를 일관되게 유지할 수 있나요?
클립이 컷으로 시작하므로, 각 컷에 그려진 캐릭터가 그대로 해당 클립에 들어갑니다. 할 수 없는 것은 같은 요청에서 컷을 고정하면서 캐릭터 레퍼런스 이미지를 추가하는 것입니다. 요청에 frame_images와 input_references가 모두 있으면 frame_images가 우선하고 요청은 이미지로 영상 만들기로 처리되므로, 레퍼런스는 버려집니다. 문서는 클립마다 똑같은 모습을 보장하지 않으며, 입력별 비교는 여러 AI 영상 샷에서 캐릭터 일관성 유지하기에 있습니다.
컷들을 어떻게 모션 코믹으로 만드나요?
Timeline 1.0이 렌더 한 번으로 클립을 읽는 순서대로 잇습니다. 슬롯은 1–200개이고 슬롯마다 start와 duration이 있으며, 슬롯 사이에는 최대 1초의 페이드, 와이프, 슬라이드, 디졸브를 넣을 수 있습니다. 모양이 출력과 다른 클립에는 fit에 cover(기본값), contain, stretch, blur 중 하나를 지정합니다.
모든 슬롯은 이미 이 워크스페이스의 media.sume.com 파일이어야 합니다. 생성한 클립은 이 조건을 만족하지만 내 컷 파일은 그렇지 않고, 공개 API에는 업로드 경로가 문서화되어 있지 않으므로, 각 컷은 해당 클립의 형태로 타임라인에 들어갑니다. 소리는 오디오 스파인에서 나옵니다. 텍스트 음성 변환으로 만든 내레이션이나 Sume Music Router로 만든 트랙을 쓰고, 소리가 필요 없으면 audio.mode: "silence"를 지정하세요. 현재 코드에서는 클립 자체의 오디오가 섞이지 않습니다. 출력 변의 길이는 256–2160픽셀이며, 기본값은 1080×1920입니다. 요청은 롱폼 영상을 조립하는 방법에서 다룹니다.
어떤 제한이 있나요?
- 글씨와 말풍선: 컷이 움직이기 시작한 뒤에도 읽을 수 있게 유지된다는 보장은 문서에 없습니다.
- 그림체: 클립은 컷으로 시작하지만, 그 뒤의 움직임이 그림체를 얼마나 유지하는지는 문서가 보장하지 않습니다.
- 화면 비율: 모델마다 나열한 값만 가능하며, 2:3과 4:5는 없습니다.
- 클립 길이: 모델에 따라 생성 한 번에 2–30초입니다.
- 프레임 URL은 공개 HTTPS여야 하며, 서명된 URL은 거부됩니다.
출처
관련 글
활용 사례 카테고리의 다른 글
- AI로 옛날 사진을 움직일 수 있나요? 인화 사진을 영상으로
네. 인화 사진을 스캔해 공개 링크에 올리고, 이미지로 영상 만들기 클립의 첫 프레임으로 보내세요. 업스케일, 사진 비율, 기대할 수 있는 결과를 다룹니다.
- AI로 YouTube Shorts 자동화하기: 생성 후 업로드
AI로 YouTube Shorts를 자동화하는 일은 두 가지 작업입니다. 스케줄에 맞춰 세로 영상을 생성하고, 여러분의 코드에서 YouTube Data API로 업로드하세요.
- 비포 애프터 영상 생성 API: 변화를 드러내는 장면 만들기
Sume API로 비포 애프터 영상을 만들려면 sume-before-after Format을 호출하거나, 첫·마지막 프레임을 지정한 클립을 만들거나, 스틸 두 장을 Timeline 와이프로 이으세요.
- 블로그 글 영상 변환 AI: 새 글마다 영상 만들기
블로그 글 영상 변환 AI는 글을 내레이션 영상으로 만듭니다. 자동화하려면 새 글의 텍스트를 지출 상한, 글에 묶인 키와 함께 영상 에이전트에 보내세요.
작성자 Sume