AI 영상 네거티브 프롬프트: 클립에서 원치 않는 요소 빼는 법
Sume 영상 API에는 네거티브 프롬프트 필드가 없고, 현재는 보내면 400이 반환됩니다. 원하는 샷을 설명한 뒤 샷의 프레임, 룩, 소리를 고정하세요.

네거티브 프롬프트는 이런 필드를 제공하는 도구에서, 생성된 이미지나 클립에 들어가면 안 되는 요소를 따로 적는 목록입니다. Sume 영상 API에는 이 필드가 없습니다. POST /v1/videos에는 negative_prompt 필드가 없으며, 현재는 이 필드를 보낸 요청이 Job이 시작되기 전에 400으로 거부됩니다. Sume에서 AI 영상에 원치 않는 요소가 들어가지 않게 하려면 원하는 샷을 프롬프트에 설명하고, 바뀌면 안 되는 부분은 첫 프레임, 레퍼런스 이미지, 오디오 스위치로 고정하세요.
요청 필드는 2026-09-27에 확인한 Sume의 영상 생성 문서 (영문)와 Sume API 레퍼런스의 요청 스키마에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 API 코드에서 확인한 것입니다.
Sume 영상 API는 네거티브 프롬프트를 받나요?
받지 않습니다. 문서가 POST /v1/videos에 나열한 요청 파라미터 중에 네거티브 프롬프트는 없으며, 요청 스키마는 정의하지 않은 필드를 허용하지 않습니다. 설명은 prompt에 넣습니다. 문서는 prompt를 생성할 영상의 텍스트 설명이라고 부릅니다.
현재 코드에서는 정의되지 않은 필드가 검증에서 400 invalid_request로 실패하며, 메시지는 “Invalid request body.”이고 details.errors가 문제를 알려 줍니다. 검증은 Job이 제출되기 전에 실행되므로, 거부된 요청으로는 Job이 만들어지지 않습니다. 이 경로의 다른 거부 사례는 영상 생성 API 400 오류에서 다룹니다.
AI 영상에서 원치 않는 요소는 어떻게 빼나요?
Sume 문서는 영상 모델이 프롬프트의 “no X” 같은 표현을 어떻게 해석하는지 설명하지 않습니다. 대신 요청 필드는 문서화되어 있으며, 필드마다 클립의 한 부분을 고정합니다.
| 피하려는 것 | 사용할 입력 | 비고 |
|---|---|---|
| 네거티브 프롬프트에 적을 만한 것: 텍스트, 불필요한 인물, 잡동사니 | prompt | 원하는 샷을 설명. 제외 항목을 위한 필드는 없음. |
| 계획하지 않은 장면에서 시작하는 클립 | first_frame을 담은 frame_images | 이미지로 영상 만들기. 이미지가 클립의 첫 프레임이 됨. |
| 다른 장면에서 끝나는 클립 | last_frame을 담은 frame_images | 같은 요청에 first_frame이 필요함(현재 코드). |
| 룩이나 캐릭터가 어긋나는 것 | input_references 이미지 | 정확한 프레임이 아닌 시각적 가이드. 프레임도 함께 보내면 프레임이 우선함. |
| 생성된 소리 | generate_audio: false | gemini-omni-flash-1.1에서 거부되고, 현재 코드에서는 minimax-h3와 minimax-h3-max에서도 거부됨. 세 모델 모두 항상 오디오를 만듦. |
{
"model": "seedance-2",
"prompt": "One woman in a gray coat in front of a plain white wall turns to camera. Static medium shot, soft window light from the left.",
"frame_images": [
{
"type": "image_url",
"image_url": { "url": "https://example.com/first-frame.png" },
"frame_type": "first_frame"
}
],
"generate_audio": false
}대신 프롬프트에는 무엇을 써야 하나요?
화면에 있어야 할 것을 쓰세요. Sume가 권하는 영상 프롬프트 모범 사례는 움직임, 카메라 앵글, 조명, 장면 구성을 자세히 담아 구체적이고 묘사적으로 쓰는 것입니다. 이미지 도구의 네거티브 프롬프트라면 “text, crowd, blur”라고 적을 자리에 원하는 화면을 대신 설명하세요. 인물 한 명, 무늬 없는 흰 벽, 고정된 카메라, 부드러운 빛처럼 적습니다.
제외할 내용을 포지티브 프롬프트에 넣으라는 Sume의 안내가 있기는 하지만, 음악에 대한 것입니다. Music Router 문서는 비어 있지 않은 negative_prompt를 지원하지 않는다고 하며, 예시 프롬프트는 “Instrumental, no vocals.”로 끝납니다. 영상 문서에는 이런 규칙이 없으므로, 영상 프롬프트의 “no X” 같은 표현은 보장된 동작이 아니라 사용하는 모델에서 테스트해 볼 대상으로 여기세요.
“no X” 표현이 통하는지 어떻게 테스트하나요?
실행할 때마다 표현만 바꾸고 나머지는 모두 고정하세요. 같은 model, duration, resolution, aspect_ratio를 쓰고, first_frame을 쓴다면 같은 first_frame을 보내 모든 테이크가 같은 이미지로 시작하게 합니다. 그 프레임 다음에 무엇이 나올지는 문서가 보장하지 않으므로, 각 클립은 쓰기 전에 검토하세요.
그래도 실행은 매번 이전 테이크를 고치는 것이 아니라 새 테이크를 만듭니다. seed를 받는 v1 영상 모델이 없어서, 단어 하나만 바꾼 채 클립을 재현하는 방법은 문서화되어 있지 않습니다. 대신 무엇을 고정해야 하는지는 AI 영상 시드란 무엇인가요?에서 다룹니다.
출처
관련 글
모델 카테고리의 다른 글
- 프롬프트 AI 음성 생성기: 화자를 설명해 목소리 만들기
프롬프트 기반 AI 음성 생성기는 글로 쓴 설명으로 새 목소리를 디자인합니다. Sume에서는 에셋 → 보이스에서 사람을 설명한 뒤, 그 목소리를 TTS에 쓰세요.
- 내 목소리로 AI 보이스오버 만들기: 한 번 클론해 TTS에 재사용
내 목소리로 AI 보이스오버를 만들려면 Sume의 Voices 라이브러리에서 짧은 클립으로 목소리를 한 번 클론한 뒤, 그 ID를 TTS 음성으로 쓰세요.
- AI로 사진 두 장을 한 장으로 합치는 방법
네, AI로 사진 두 장을 한 장으로 합칠 수 있습니다. 두 사진을 레퍼런스로 이미지 모델에 보내고 원하는 장면 하나를 설명하세요. Sume로 하는 방법을 소개합니다.
- AI 이미지 캐릭터 일관성 유지하기: 레퍼런스 한 장 재사용
AI 이미지에서 캐릭터를 일관되게 유지하려면 요청마다 같은 레퍼런스 이미지를 보내고, 같은 설명을 반복하고, 장면만 바꾸세요.
작성자 Sume