AI 영상 4K 화질 프롬프트: 해상도를 실제로 정하는 것
프롬프트에 4K라고 써도 Sume에서 해상도가 정해지지는 않습니다. 4K를 나열한 모델의 resolution 필드로 4K를 요청하거나, 완성된 클립을 업스케일하세요.

프롬프트에 “4K”나 “ultra HD” 같은 단어를 넣는 것은 4K AI 영상을 얻는 문서화된 방법이 아닙니다. Sume에서 해상도는 별도의 요청 필드입니다. 4K를 나열한 모델에 resolution: "4K"를 보내고, 프롬프트는 샷 자체를 설명하는 데 쓰세요. 4K를 나열한 모델은 gemini-omni-flash-1.1 하나이며, 대신 완성된 클립을 업스케일할 수도 있습니다.
필드와 한도는 2026-09-27에 확인한 Sume의 영상 생성 (영문), Video Router (영문), Timeline 1.0 문서와 Sume API 레퍼런스에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 API 코드에서 확인한 것입니다. 모든 모델의 해상도는 4K AI 영상 생성 API에 정리되어 있습니다.
프롬프트에 4K를 넣으면 영상이 4K가 되나요?
모델을 지정한 경우에는 아닙니다. 문서는 prompt를 영상의 텍스트 설명으로, resolution을 출력 영상의 해상도로 정의하며, 이 값은 모델이 supported_resolutions에 공개한 값, 그리고 minimax-h3의 유료 2K·4K 업스케일과 대조됩니다. 현재 코드에서는 모델에 전달되는 해상도가 이 필드의 값이며, 모델이 받지 않는 값은 400 unsupported_capability로 거부됩니다.
요금도 이 필드를 따릅니다. Gemini Omni Flash 1.1은 해상도별 출력 초당 요금으로 청구됩니다. sume/auto를 쓰면 Sume가 모델 계열을 고르며, 문서화된 기본값은 720p와 8초이므로, 4K가 필요하면 모델을 지정하세요.
네이티브 4K와 업스케일 4K는 무엇이 다른가요?
네이티브는 모델이 그 크기로 프레임을 생성한다는 뜻입니다. 업스케일은 더 작은 클립을 먼저 생성한 뒤 두 번째 처리 단계에서 키운다는 뜻입니다. Sume에서 4K에 이르는 방법은 세 가지이며, 문서는 디테일 면에서 이들을 비교하지 않으므로 결과물은 직접 판단하세요.
| 경로 | 4K에 이르는 방식 | 제한 |
|---|---|---|
gemini-omni-flash-1.1 | 360p, 720p, 1080p와 함께 4K를 생성 해상도로 나열 | 3–10초, 16:9 또는 9:16 |
minimax-h3 | 2K와 4K는 네이티브 768p 출력을 업스케일한 것이며, 요청하면 요금이 붙음 | 5–15초 |
| Video Upscale 1.0 | 완성된 클립을 scale_ratio 1.1–4배로 확대 | Job당 video_url 하나 |
클립을 4K로 다시 생성해야 하나요, 업스케일해야 하나요?
Sume가 에이전트에게 주는 도구 가이드는 이미 있는 클립을 업스케일러로 보내라고 하며, “Do not regenerate a clip to make it bigger.”(클립을 키우려고 다시 생성하지 마세요)라고 말합니다. 새로 생성하면 새 테이크가 나오며, 어떤 v1 영상 모델에도 seed가 없어서 같은 테이크를 다시 얻는 방법은 문서화되어 있지 않습니다. 업스케일은 이미 승인한 클립에 그대로 적용됩니다.
Video Upscale 1.0(POST /v1/video-upscale-1.0/upscale)은 클립을 공개 HTTPS video_url로 받아 scale_ratio 1.1에서 4 사이로 확대하며, API 요금에 나온 요금은 영상 초당 $0.009이고 기본적으로 5.5% 에이전트 수수료가 더해집니다. 요청과 향상 등급은 AI 영상 업스케일러 API에서 다룹니다.
고화질 영상 프롬프트에는 무엇을 써야 하나요?
샷을 설명하세요. Sume의 모범 사례는 움직임, 카메라 앵글, 조명, 장면 구성을 자세히 담은 구체적이고 묘사적인 프롬프트입니다. 문서에 따르면 해상도가 높을수록 생성 시간이 길고 비용이 더 들므로, 용도에 맞는 해상도를 고르세요. 4K 요청에서는 픽셀 크기를 해당 필드에 담습니다.
{
"model": "gemini-omni-flash-1.1",
"prompt": "Slow dolly-in on a ceramic mug on a sunlit oak table, steam rising, shallow depth of field, warm morning light",
"resolution": "4K",
"aspect_ratio": "16:9",
"duration": 8
}Sume에서 4K에는 어떤 제한이 있나요?
- Gemini Omni Flash 1.1 클립은 3–10초이며, 16:9 또는 9:16만 가능합니다.
- Video Upscale 1.0은 입력을 최대 30초까지만 예약합니다.
duration_seconds필드의 상한이 30입니다. - Timeline 1.0의 출력 너비와 높이는 256에서 2160 사이의 짝수 정수이므로, 여기서 이어 붙인 프로그램은 너비 3,840픽셀인 UHD 4K 프레임을 유지할 수 없습니다.
- 현재 코드에서는 지정한 모델이 받지 않는 해상도를 보내면 Job이 시작되기 전에 거부됩니다.
출처
관련 글
모델 카테고리의 다른 글
- 이미지 여러 장으로 AI 영상 만들기: 프레임, 레퍼런스, 스틸
Sume에서 AI 클립 하나는 이미지 두 장을 첫 프레임과 마지막 프레임으로 받습니다. 그보다 많다면 두 장씩 클립을 잇거나, 레퍼런스로 쓰거나, 스틸로 보여 주세요.
- AI 영상 네거티브 프롬프트: 클립에서 원치 않는 요소 빼는 법
Sume 영상 API에는 네거티브 프롬프트 필드가 없고, 현재는 보내면 400이 반환됩니다. 원하는 샷을 설명한 뒤 샷의 프레임, 룩, 소리를 고정하세요.
- 프롬프트 AI 음성 생성기: 화자를 설명해 목소리 만들기
프롬프트 기반 AI 음성 생성기는 글로 쓴 설명으로 새 목소리를 디자인합니다. Sume에서는 에셋 → 보이스에서 사람을 설명한 뒤, 그 목소리를 TTS에 쓰세요.
- 내 목소리로 AI 보이스오버 만들기: 한 번 클론해 TTS에 재사용
내 목소리로 AI 보이스오버를 만들려면 Sume의 Voices 라이브러리에서 짧은 클립으로 목소리를 한 번 클론한 뒤, 그 ID를 TTS 음성으로 쓰세요.
작성자 Sume