휴먼 인 더 루프 AI 에이전트: 사람은 어디서 승인하나요?
휴먼 인 더 루프는 AI 에이전트가 중요한 단계 앞에서 멈추고 사람을 기다리는 방식입니다. Sume 에이전트가 채팅에서 이를 어떻게 하는지, API 실행에서는 무엇이 대신하는지 설명합니다.

휴먼 인 더 루프(human in the loop)란 AI 에이전트가 돈을 쓰거나, 게시하거나, 삭제하는 것처럼 중요한 단계 앞에서 멈추고 사람의 승인이나 수정을 기다리는 방식입니다. 루프에 사람이 없는 에이전트는 스스로 행동하므로, 한도는 모두 미리 정해 두어야 합니다. Sume 영상 에이전트는 두 방식으로 모두 동작합니다. 채팅에서는 지출하기 전에 묻고, API 실행과 예약 실행은 무인으로 진행되므로 지출 상한이 승인을 대신하며, 정말로 사람이 필요한 실행은 반쯤 끝난 상태가 아니라 failed로 돌아옵니다.
Sume 쪽 내용은 2026-09-27에 확인한 빠른 시작, Format API (영문), Format 호출하기 (영문), Agent Completions 문서에서, 문서에 설명이 없는 부분은 현재 서버 코드에서 가져왔습니다. MCP 관련 문장은 MCP 명세의 Tools 페이지에서 가져왔습니다.
Sume 영상 에이전트에서 사람은 어디서 승인하나요?
에이전트 채팅에서 승인합니다. Sume 문서는 사람이 루프에 남아야 할 때 에이전트 탭을 쓰라고 합니다. 브리프를 쓰고, 검토하고, 반복한 뒤, 결과를 재사용 가능한 레시피로 저장하는 흐름입니다. 모델은 에이전트가 고르고 지출하기 전에 먼저 물으며, 스레드에는 모든 아티팩트와 승인 기록이 남습니다. 최종 렌더에 크레딧을 쓰기 전에 초안을 먼저 보여 달라고 하는 것처럼, 브리프에 자체 확인 단계를 넣을 수도 있습니다.
지켜보는 사람이 없으면 어떻게 되나요?
API에는 대답할 사람이 없습니다. Format 실행은 무인으로 진행되는 턴 하나입니다. 사람에게 무언가를 묻기 위해 멈추지 않고, 채팅에서 만든 레시피라면 요청했을 승인은 미리 부여되며, 실행은 지출 상한 안에서 유료 단계까지 계속 진행합니다. 현재 코드에서는 이것이 실행 프롬프트에 덧붙는 텍스트입니다. 에이전트 UI에서 시작한 실행은 승인을 위한 멈춤을 그대로 유지하고, API 실행과 예약 실행은 질문에 답할 사람이 없으며 승인 게이트는 이미 부여됐다는 안내를 받습니다.
에이전트가 정말로 더 진행할 수 없으면 실행은 반쯤 끝난 completed가 아니라 failed로 끝납니다. 오류 코드 unattended_blocked는 사람 없이는 통과할 수 없는 게이트에 막혔다는 뜻입니다. 브리프에 맞는 아바타가 없거나, 채팅이었다면 물어봤을 입력이 빠진 경우가 그 예입니다. 입력이나 브리프를 고친 뒤 새 Idempotency-Key로 다시 시도하세요.
무엇이 승인을 대신하나요?
지출 상한입니다. Agent Completions에서는 상한이 필수입니다. 채팅의 대화형 지출 승인 프롬프트를 백엔드 호출자는 쓸 수 없으므로 generation_spend_cap_usd에는 기본값이 없으며, 문서는 상한을 그 프롬프트의 대체물이라고 부릅니다. 표면마다 상한을 어떻게 강제하는지는 무인 AI 에이전트 지출 상한에서 다룹니다.
| 실행 시작 방식 | 사람 개입 여부 | 지출을 제한하는 것 |
|---|---|---|
| 에이전트 채팅에서 사람이 시작 | 예. 에이전트가 지출 전에 물음 | 사람의 승인 |
| API로 하는 Format 실행 | 아니요. 승인이 미리 부여됨 | 실행의 상한 또는 Format의 상한. Format이 한 번도 지정하지 않았다면 $400 |
| 예약 실행 | 아니요. 승인이 미리 부여됨 | 스케줄의 실행당 상한. 설정하지 않으면 $1.00 |
| Agent Completion | 아니요. 지출 승인 프롬프트를 쓸 수 없음 | 모든 요청에 필수인 generation_spend_cap_usd |
채팅 밖에서는 어떻게 사람을 루프에 두나요?
승인을 실행이나 호출 안이 아니라 그 사이에 두세요.
- 검토한 뒤 이어 가기. Format 실행은 에이전트 턴 하나입니다. 결과를 검토자에게 보여 준 뒤, 검토자의 메모를
instruction으로 넣고 새 실행에previous_run_id를 보내세요. 에이전트는 자신이 만든 결과를 다시 전달받으므로 한 부분만 다시 만들고 나머지는 그대로 둘 수 있습니다. Sume API로 AI 영상의 장면 하나를 다시 생성하기에서 보듯, 이어 가는 실행은 자체 지출 상한이 있는 새 실행입니다. - 스틸부터 승인하기. 아바타 영상 프리뷰는 전체 토킹 영상 렌더를 시작하지 않고 첫 프레임 스틸만 생성하므로, Avatar Video 생성 비용을 온전히 쓰기 전에 사람이 구도를 승인할 수 있습니다.
- 도구 호출에 게이트 두기. Sume 호스팅 MCP에서 OAuth 세션은 사용자가 동의 화면에서 Write를 부여하기 전까지 읽기 전용 도구만 볼 수 있고,
dry_run=true는 제출하지 않고 접수 여부와 비용을 미리 보여 줍니다. 필수인idempotency_key는 중복 제거용이며 사람의 승인이 아닙니다. MCP 명세는 도구 호출을 거부할 수 있는 사람이 항상 루프 안에 있어야 한다(SHOULD)고 말합니다.
휴먼 인 더 루프와 자율 실행 중 무엇을 써야 하나요?
Sume 문서는 단계에 따라 나눕니다. 사람이 루프에 남아야 할 때는 대화형 채팅이 맞는 표면이며, 레시피가 다듬어지는 곳도 여기입니다. 레시피가 고정되고 입력만 바뀐다면 Format 실행이 맞는 경로이며, 문서는 파트너 연동을 채팅 스레드가 아니라 실행 위에 만들라고 합니다. 작업을 아직 정의하는 동안에는 사람이 승인하고, 작업이 반복되기 시작하면 지출 상한과 정직한 failed 상태가 그 역할을 넘겨받습니다. 같은 질문의 MCP 쪽 답은 유료 API를 호출하는 AI 에이전트의 안전한 자동화를 참고하세요.
출처
관련 글
에이전트 카테고리의 다른 글
- 이미지 편집 MCP 서버: 스타일 변경·배경 제거·업스케일
Sume 호스팅 MCP 서버는 에이전트에게 세 가지 이미지 편집을 제공합니다. 레퍼런스 이미지를 프롬프트로 편집하기, 배경을 제거해 알파 채널 PNG 만들기, 업스케일입니다.
- Claude로 AI UGC 영상 만들기: 아바타, 음성, 립싱크
Claude 모델의 출력은 텍스트입니다. Write를 켜고 Sume 호스팅 MCP 서버를 연결하면 Claude가 UGC 스타일 아바타 클립의 스크립트, 음성, 립싱크를 만들 수 있습니다.
- MCP 프롬프트 인젝션: 탈취된 에이전트가 할 수 있는 일 제한하기
MCP 프롬프트 인젝션은 아무도 요청하지 않은 도구를 에이전트가 호출하게 만듭니다. 대신 세션을 제한하세요. 도구는 줄이고, 기본은 읽기 전용으로 두고, 쓰기는 확인을 거치게 하세요.
- MCP 서버와 AI 에이전트의 차이는 무엇인가요?
MCP 서버는 도구를 노출하고, 에이전트는 모델이 어떤 도구를 호출할지 정하는 프로그램입니다. Sume의 서버와 에이전트로 일이 어떻게 나뉘는지 봅니다.
작성자 Sume