부동산 중개사 AI 영상: 모든 매물에 아바타 하나로
부동산 중개사는 촬영 없이 AI 영상을 만들 수 있습니다. 사진으로 아바타를 한 번 만든 뒤, 매물 사진을 장면으로 삼아 영상마다 스크립트를 쓰세요.

부동산 중개사는 영상을 하나하나 촬영하지 않고도 AI 영상을 만들 수 있습니다. 내 사진으로 AI 아바타를 한 번 만든 다음, 매물 소개, 오픈 하우스 초대, 시장 동향 업데이트 같은 스크립트를 하나씩 그 아바타가 말하는 영상으로 바꾸세요. Sume에서는 Avatar 1.0으로 만들며, 영상 하나는 최대 60초이고 매물 사진을 장면 레퍼런스로 씁니다. 먼저 두 가지를 알아 두세요. 현재 코드에서 아바타는 내 사진을 바탕으로 생성된 닮은 모습이며, 내 목소리가 아니라 생성된 목소리로 영어를 말합니다.
이 글의 내용은 2026-09-27에 확인한 Sume의 아바타 만들기, 아바타 영상 생성, 아바타 영상 프리뷰 문서와 Sume API 레퍼런스에서 가져왔습니다. 현재 동작이라고 설명한 내용은 Sume의 코드에서 확인한 것입니다. 매물 사진 자체로 만드는 투어 영상은 부동산 사진을 AI 영상으로를 참고하세요.
내가 나오는 부동산 AI 영상은 어떻게 만드나요?
POST /v1/avatar-1.0/generate로 아바타를 한 번 만드세요. 고정된avatar_handle과, 공개 HTTPS URL에 있는 내 사진을 담은input: { "type": "photo", "image_url": "https://…" }를 보냅니다. 생성은 Job이며, 완료되면 모든 영상에 그 handle을 재사용하세요. 요청은 재사용 가능한 AI 아바타 만들기에 나와 있습니다.- 스크립트는 Sume가 4–60초로 추정하도록 쓰고, 더 긴 스크립트는 여러 영상으로 나누세요.
- 스크립트와 handle을
POST /v1/avatar-1.0/talking-video로 보내세요.aspect_ratio는1:1,3:4,9:16,4:3,16:9(기본값9:16)를 받으며, 문서화된 해상도는 720p입니다.
curl -X POST https://api.sume.com/v1/avatar-1.0/talking-video \
-H "Authorization: Bearer $SUME_API_KEY" \
-H "Content-Type: application/json" \
-H "Idempotency-Key: listing-intro-001" \
-d '{
"avatar_handle": "acme",
"script": "Welcome to 12 Harbor Lane: three bedrooms, a sunny kitchen, and a garden made for summer evenings. Book a tour this weekend.",
"scene": { "type": "photo", "image_url": "https://example.com/listing/kitchen.jpg" },
"aspect_ratio": "9:16"
}'아바타 뒤에 매물 사진을 넣을 수 있나요?
네, 레퍼런스로 넣을 수 있습니다. 문서는 scene: { "type": "photo", "image_url": … }를 사진 장면 레퍼런스라고 부르며, 사진은 공개 HTTPS URL에 있어야 합니다. 문서는 방이 사진과 똑같이 나온다고 약속하지 않고, 영상 하나는 공유 장면 하나로 해석되므로 영상마다 방 하나를 계획하세요. 매물을 기록하는 자료로는 실제 매물 사진을 그대로 쓰세요. 장면 필드는 API로 제품과 배경을 넣은 AI 아바타 영상 만들기에서 다룹니다.
전체 렌더 전에 첫 프레임은 어떻게 확인하나요?
먼저 같은 본문을 POST /v1/avatar-video-previews로 보내세요. 전체 렌더를 시작하지 않고 첫 프레임 스틸인 preview_image_url을 생성하므로, 배경 앞에 선 아바타를 확인할 수 있습니다. POST /v1/avatar-video-previews/:id/regenerate는 스틸을 새로 만들고, POST /v1/avatar-video-previews/:id/generate-video는 최종 영상을 시작하며, 가능하면 프리뷰의 첫 프레임을 재사용합니다. 자막은 프리뷰를 만들 때 넣으세요. 자막은 generate-video 단계에서 입혀지며, 현재 코드에서 talking-video 생성 요청은 자막을 받지 않습니다. 이 흐름은 아바타 영상 프리뷰에서 다룹니다.
아바타가 나와 똑같이 생기고 내 목소리로 말하나요?
똑같지는 않습니다. 현재 코드에서 사진 아바타는 이미지 모델이 내 사진을 바탕으로 다시 그리므로, 내 사진 그대로가 아니라 생성된 닮은 모습입니다. 목소리는 그 외모에 맞게 생성되어 영어로 클론되며, 아바타는 영어만 말합니다. talking-video 요청에는 목소리를 고르는 필드가 없습니다.
내 얼굴과 목소리로 나오거나 다른 언어로 고객에게 다가가려면, Sume 앱에서 목소리를 클론하고, TTS 1.0으로 스크립트의 음성을 만든 뒤(영어가 아닌 스크립트라면 language를 지정), VEED Fabric 1.0으로 내 사진을 그 오디오에 립싱크하세요. 이 경로는 AI로 나를 클론하는 방법에서 다룹니다. 내 모습만 쓰거나, 동료의 모습은 본인의 동의를 받아 쓰세요.
부동산 AI 영상의 비용은 얼마인가요?
아바타 생성은 아바타당 $0.95의 일회성 요금입니다. 영상은 품질 등급별로 초 단위로 과금되며, quality의 기본값은 plus입니다. 모든 금액에는 기본적으로 5.5% 에이전트 수수료가 더해집니다.
출처
관련 글
Sume Avatar 1.0 카테고리의 다른 글
- AI 아바타 스크립트: 60초에 몇 단어가 들어가나요?
AI 아바타 스크립트는 아바타가 말하는 대사입니다. 현재 Sume의 추정기는 초당 2.8단어로 세므로, 60초에는 약 165단어가 들어갑니다.
- 토킹 헤드 영상 배경 음악: 목소리 아래에 까는 BGM
배경 음악은 목소리보다 충분히 작게 까세요. Sume 아바타 영상 프리뷰에는 볼륨 0.05~0.4의 사운드트랙을 넣을 수 있고, Timeline은 페이드와 더킹을 더합니다.
- 토킹 헤드 영상 포맷: 화면 비율, 크기, 파일 형식
토킹 헤드 영상의 포맷은 재생되는 곳에 따라 세로, 16:9, 정사각형, 4:5로 정해집니다. Sume 아바타 영상은 다섯 가지 비율의 720p MP4로 나옵니다.
- 토킹 헤드 영상 API: 아바타 vs 립싱크 vs 모션 컨트롤
가진 입력으로 Sume 토킹 헤드 경로를 고르세요. 스크립트와 준비된 아바타, 직접 만든 오디오와 스틸, 또는 드라이빙 영상입니다. 제한과 초당 가격도 다룹니다.
작성자 Sume