AI Instagram 캐러셀 생성기: 같은 크기, 같은 스타일로
캐러셀의 모든 슬라이드를 4:5나 1:1 중 한 화면 비율로 생성하고, 승인한 슬라이드를 스타일 레퍼런스로 재사용하세요. Instagram 규칙과 API 사용법을 정리했습니다.

AI Instagram 캐러셀 게시물 생성기는 서로 어울리는 슬라이드를 만들어야 합니다. Instagram은 모든 캐러셀 이미지를 첫 번째 이미지 기준으로 자르므로, 모든 슬라이드를 4:5 세로형이나 1:1 정사각형 중 같은 화면 비율로 생성하세요. 그런 다음 세트 전체의 룩을 하나로 유지하세요. 모든 프롬프트에 같은 스타일 설명을 반복하고, 승인한 슬라이드를 레퍼런스 이미지로 모델에 넘기면 됩니다.
Sume에서는 슬라이드 하나가 4:5를 나열하는 모델에 보내는 POST /v1/images 호출 한 번입니다. Sume 관련 사실은 Image API 문서 (영문)와 현재 API 코드에서, Instagram 수치는 Meta의 콘텐츠 게시 가이드와 IG User media 레퍼런스에서 가져왔습니다. 모두 2026-09-27에 확인했습니다.
Instagram 캐러셀 슬라이드는 어떤 크기여야 하나요?
게시물 전체에 쓸 모양을 하나 고르세요. Instagram API로 게시하는 이미지에 대해 Meta는 다음 규칙을 문서화하고 있습니다. 이 규칙이 허용하는 가장 세로로 긴 모양이 4:5이고, 캐러셀 기본값은 1:1입니다.
| 규칙 | Meta 문서 내용 |
|---|---|
| 캐러셀 자르기 | 모든 캐러셀 이미지는 첫 번째 이미지 기준으로 잘림. 기본값은 1:1. |
| 캐러셀당 항목 수 | 이미지, 영상 또는 둘을 섞어 최대 10개. |
| 화면 비율 | 4:5에서 1.91:1 사이 범위여야 함. |
| 너비 | 최소 320, 최대 1440. 범위를 벗어난 이미지는 크기가 조정됨. |
| 파일 | JPEG만, 최대 8 MB. 다른 색 공간은 sRGB로 변환됨. |
AI 이미지 API로 캐러셀 슬라이드를 어떻게 생성하나요?
슬라이드마다 보여 주는 내용이 다르므로 슬라이드 하나에 요청을 하나씩 보내세요. n은 연속된 슬라이드가 아니라, 같은 슬라이드의 시안을 여러 장 만들어 그중에서 고를 수 있게 해 줍니다. Image API 문서는 요청당 최대 10장을 허용하면서 모델별 상한은 그보다 낮다고 밝히며, 현재 코드는 대부분의 모델을 4장으로 제한합니다.
4:5(또는1:1)를 나열하는 모델을 고정하고, 모든 슬라이드에 같은aspect_ratio를 보내세요. 모델은 카탈로그 디스크립터에 나열된 값만 받습니다. 모델별 목록은 화면 비율 가이드에서 볼 수 있습니다.- Instagram API로 게시한다면
output_format: "jpeg"를 요청하세요. Instagram API는 JPEG만 받습니다. - 팔레트, 조명, 구도 같은 스타일 블록 하나를 모든 프롬프트에 한 글자도 바꾸지 않고 넣고, 슬라이드가 보여 주는 내용만 바꾸세요.
curl -X POST "https://api.sume.com/v1/images" \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2.5",
"prompt": "Slide 1 of 5, cover: a ceramic mug on a linen table. Style: warm film photo, soft window light, cream and terracotta palette.",
"aspect_ratio": "4:5",
"output_format": "jpeg",
"n": 4
}'모든 슬라이드를 같은 스타일로 유지하려면 어떻게 하나요?
승인한 슬라이드를 레퍼런스로 재사용하세요. 그 뒤의 모든 요청에서 이 슬라이드의 공개 HTTPS URL을 input_references에 담아 보내고, 아래의 두 번째 슬라이드 요청 본문처럼 무엇을 유지하고 무엇을 바꿀지 프롬프트에 적으세요.
- ChatGPT Image 2.5는 레퍼런스 이미지를 최대 16장까지 받습니다.
input_references범위가 0에서 0인 모델은 텍스트로 이미지 만들기만 지원하며 레퍼런스를 거부합니다. - localhost, 사설 네트워크, HTTPS가 아닌 레퍼런스 URL은 제출 전에 거부됩니다.
- 룩을 고정할 시드는 없습니다.
seed는 스키마에 있지만 제공되지 않으므로, 보내면400 unsupported_parameter가 반환됩니다. - 그래도 슬라이드는 하나하나 새로 생성되므로, 게시하기 전에 세트 전체를 비교하세요. 자세한 내용은 여러 이미지에서 캐릭터 일관성 유지하기를 참고하세요.
{
"model": "openai/gpt-image-2.5",
"prompt": "Slide 2 of 5: the same mug, held in two hands. Keep the style, palette, light, and framing of the reference image.",
"aspect_ratio": "4:5",
"output_format": "jpeg",
"input_references": [
{ "type": "image_url", "image_url": { "url": "https://example.com/carousel/slide-1.jpg" } }
]
}생성기로 정확한 픽셀 크기를 출력할 수 있나요?
모든 크기가 되지는 않습니다. ChatGPT Image 모델에서 커스텀 크기는 양변이 모두 16의 배수여야 하므로 1080×1350은 쓸 수 없고, 현재 코드는 이 모델들의 aspect_ratio: "4:5"를 1024×1280으로 제공합니다. 이 너비는 Meta 문서에 나온 320에서 1440까지의 범위 안에 있습니다. 정확한 픽셀이 필요하면 내려받은 파일의 크기를 직접 조정하세요. 다른 모델의 커스텀 크기는 화면 비율 가이드에서 다룹니다.
캐러셀 비용은 얼마이고, 어떤 제한이 있나요?
n으로 받은 이미지는 모두 과금되고, 기본적으로 5.5% 에이전트 수수료가 더해집니다. 그래서 슬라이드 다섯 장에 시안을 네 장씩 받으면 과금되는 이미지는 20장입니다. ChatGPT Image 2.5는 토큰 기준으로 가격이 매겨지므로, 크기와quality가 이미지 한 장 한 장의 가격을 정합니다. 실패한 생성은 과금되지 않습니다. 모든 모델의 가격은 AI 이미지 생성 API 비용에 나와 있습니다.- 큰
n을 비롯한 느린 설정에서는 이미지가 담긴200대신 Job이 담긴202로 응답할 수 있습니다.GET /v1/jobs/{id}/status를 폴링한 뒤GET /v1/jobs/{id}/result를 가져오세요. - 결과 URL은 Sume가 호스팅하는 서명된 URL이므로, 보관할 슬라이드는 내려받으세요.
- 모델이 그린 글자는 게시하기 전에 한 글자씩 확인하세요. 이 경우는 글자가 들어간 AI 이미지에서 다룹니다.
출처
관련 글
활용 사례 카테고리의 다른 글
- AI 징글 생성기: 텍스트로 팟캐스트 인트로 만들기
텍스트 브리프로 징글이나 팟캐스트 인트로를 만드세요. 프롬프트로 길이를 요청한 뒤, 오디오 split으로 트랙을 정확한 초에 맞춰 자릅니다.
- 팩샷 한 장으로 만드는 AI 라이프스타일 제품 사진
팩샷 한 장을 라이프스타일 장면으로 바꾸세요. 팩샷을 레퍼런스로 이미지 모델에 보내고, 요청마다 장면 하나를 설명한 뒤, 제품이 일치하는 컷만 남기면 됩니다.
- AI 잡지 표지 생성 API: 글자 넣을 자리를 남긴 표지
Sume로 잡지 표지 스타일 이미지를 만들려면 사진을 담아 sume-magazine-cover-campaign Format을 실행한 뒤, 제호(마스트헤드)는 직접 얹으세요.
- AI 목업 생성기 API: 제품에 내 디자인 입히기
이미지 API로 제품 목업을 만드세요. 디자인과 무지 제품 사진을 레퍼런스로 보내고, 디자인이 들어갈 위치를 적은 뒤, 결과를 하나하나 확인하면 됩니다.
작성자 Sume