AI로 이미지 베리에이션 만드는 방법: 비슷한 이미지 여러 장
이미지를 레퍼런스로 보내고, 바꿔도 되는 것과 유지할 것을 적은 뒤, n을 설정해 호출 한 번에 결과를 여러 장 받으세요. Sume의 Image API에서 하는 방법입니다.

이미지의 베리에이션을 만들려면 AI 이미지 모델에 원본을 레퍼런스로 주고, 프롬프트에 바꿔도 되는 것과 유지해야 하는 것을 적은 뒤, 결과를 한 번에 여러 장 요청하세요. 결과는 매번 새로 생성되므로 실행할 때마다 새로운 세트가 나옵니다. 더 탐색하려면 마음에 드는 결과를 다음 레퍼런스로 다시 넣으세요.
Sume에서는 원본을 input_references에 담고 n을 원하는 베리에이션 수로 설정해 POST /v1/images를 보내면 됩니다. 아래 내용은 Image API 문서 (영문)와 GET /v1/images/models가 제공하는 카탈로그에서 가져왔으며, 2026-09-27에 확인했습니다.
호출 한 번에 베리에이션을 여러 장 받으려면 어떻게 하나요?
원본을 레퍼런스로 보내고 n을 설정하세요. 문서는 요청당 최대 10장을 허용하면서 모델별 상한은 그보다 낮다고 설명합니다. 현재 ChatGPT Image 2.5, ChatGPT Image 2, 그리고 Nano Banana 모델 두 개의 상한은 4입니다.
aspect_ratio: "auto"는 이 값을 나열하는 모델에서 원본의 모양을 유지하며, 필드를 생략하는 것은auto와 같지 않습니다.- 모델의 범위를 벗어난
n은 현재400 invalid_request로 거부됩니다. - 베리에이션 네 장은 완료된 이미지 네 장으로 과금됩니다. 실패한 생성은 과금되지 않습니다.
curl -X POST "https://api.sume.com/v1/images" \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2.5",
"prompt": "A variation of the referenced poster: keep the layout, the bicycle, and the flat illustration style; change the color palette and make the season autumn.",
"aspect_ratio": "auto",
"n": 4,
"input_references": [
{ "type": "image_url", "image_url": { "url": "https://example.com/poster.png" } }
]
}'프롬프트에는 무엇을 써야 하나요?
베리에이션이 원본에서 얼마나 벗어날지는 프롬프트로 조절하므로, 두 가지를 모두 적으세요.
- 유지: 바뀌면 안 되는 피사체, 레이아웃, 스타일, 팔레트, 문구.
- 변경: 색, 배경, 소품, 계절, 카메라 앵글, 분위기처럼 실행마다 한두 가지.
- 원본에 가까운 결과: "Recreate this image with small changes to the background only."(배경만 조금 바꿔서 이 이미지를 다시 만들기)
- 더 폭넓은 탐색: 새 스타일이나 배경을 분명하게 지정하고, 피사체만 유지.
모델별로 베리에이션을 몇 장까지 받을 수 있나요?
현재 예외는 Seedream 4.5입니다. 카탈로그에는 n이 최대 4로 나와 있지만, 레퍼런스가 있으면 호출당 이미지를 한 장만 반환하므로 베리에이션마다 호출을 한 번씩 보내세요. 레퍼런스로 편집하는 모델은 다음과 같습니다.
| 모델 ID | 레퍼런스가 있을 때 호출당 베리에이션 수 | `"auto"` 나열 |
|---|---|---|
openai/gpt-image-2.5 | 1–4 | 예 |
openai/gpt-image-2 | 1–4 | 예 |
google/nano-banana-pro | 1–4 | 예 |
google/nano-banana-2 | 1–4 | 예 |
bytedance-seed/seedream-4.5 | 1 | 아니요 |
베리에이션이 얼마나 달라질지 조절할 수 있나요?
프롬프트로만 조절할 수 있습니다. 요청에는 강도, 유사도, 베리에이션 필드가 없으며, 현재 코드에서 본문 스키마는 닫혀 있습니다. strength 같은 알 수 없는 필드는 무시되지 않고 400 invalid_request로 요청을 실패시킵니다.
"Seed for deterministic generation"(결정적 생성을 위한 시드)으로 설명된 seed는 스키마에 있지만 v1에서는 제공되지 않으므로, 보내면 400 unsupported_parameter가 반환됩니다. 다시 실행하면 새 세트가 나오므로 마음에 드는 파일은 보관하세요. 시드에 대해서는 AI 이미지 시드 번호에서 더 다룹니다.
어떤 제한이 있나요?
- 원본은 공개 HTTPS URL에 있어야 하며, 텍스트로 이미지 만들기만 지원하는 모델은 레퍼런스를 거부합니다.
- 큰
n을 비롯한 느린 설정은 이미지와 함께200을 반환하는 대신 Job과 함께202로 응답할 가능성이 가장 큽니다.GET /v1/jobs/{id}/status를 폴링한 뒤GET /v1/jobs/{id}/result를 가져오세요. - 결과 URL은 Sume가 호스팅하는 서명된 URL입니다. 보관할 베리에이션은 다운로드하세요.
- 텍스트 프롬프트만으로 이미지를 여러 장 받으려면 4K AI 이미지 생성 API: 해상도, 품질, 이미지 수를, 레퍼런스의 작동 방식은 레퍼런스 이미지 기반 이미지 생성 API를 참고하세요.
출처
관련 글
모델 카테고리의 다른 글
- 이미지로 음악 만드는 AI: 사진으로 트랙 생성하기
이미지로 음악을 만드는 AI는 사진을 트랙의 입력으로 씁니다. Sume에서는 텍스트 프롬프트와 함께 image_url을 Music Router로 보내며, 가격은 그대로입니다.
- Image-to-Video와 Reference-to-Video의 차이는?
이미지로 영상 만들기는 이미지를 첫 프레임으로 쓰고, 레퍼런스로 영상 만들기는 이미지·클립·오디오를 가이드로 씁니다. 언제 무엇을 쓰고, 함께 보내면 무엇이 우선하는지 정리했습니다.
- 한국어 TTS API: 한글 대본에 language ko 지정하기
한국어 TTS는 한글로 쓴 대본에 언어를 ko로 지정해 보내면 됩니다. Sume TTS API가 한국어를 읽는 방식, 음성 검사, 과금 방식을 설명합니다.
- AI로 사진을 움직이게 하는 법: 원하는 움직임 고르기
사진을 이미지로 영상 만들기 모델에 첫 프레임으로 넣고 움직임을 설명하세요. 춤을 따라 하게 하려면 모션 컨트롤, 얼굴이 말하게 하려면 립싱크를 씁니다.
작성자 Sume