실습 노트

Archestra로 나누는 에이전트 운영면: LLM·MCP·권한·관측

Archestra 공식 문서와 README를 바탕으로 여러 에이전트의 모델·도구·권한·비용을 분리하는 운영 구조를 정리합니다.

보일러플레이트AI 에이전트 · MCP · AI 운영

에이전트가 한두 개일 때는 모델과 도구를 코드에 직접 붙여도 됩니다. 여러 팀과 서비스가 같은 에이전트를 쓰기 시작하면 모델 호출, MCP 권한, 비용, 실행 환경, 로그가 서로 다른 곳에 흩어집니다. Archestra 공식 문서는 이 경계를 게이트웨이와 레지스트리, 런타임, 관측면으로 나눕니다.

모델 호출은 LLM 게이트웨이로 분리

공식 README는 Anthropic·OpenAI·Azure·Bedrock·DeepSeek 등 여러 공급자를 하나의 게이트웨이로 연결하고, 가상 API 키·비용 제한·동적 모델 라우팅을 제공한다고 설명합니다. 애플리케이션이 공급자별 인증과 모델 주소를 직접 관리하지 않게 만드는 층입니다.

모델 교체와 비용 통제를 함께 다루려면 다음 정보를 별도로 기록하는 편이 좋습니다.

  • 업무별 허용 모델
  • 팀·환경별 비용 한도
  • 모델 장애 시 대체 경로
  • 요청과 응답의 추적 ID

MCP는 레지스트리와 게이트웨이로 분리

MCP 도구를 에이전트 코드에 하나씩 복사하면 자격 증명과 권한 정책이 중복됩니다. Archestra는 private MCP registry로 도구를 등록하고, MCP gateway에서 OAuth와 On-Behalf-Of 호출을 제공하는 구조를 제시합니다.

이 구조에서는 도구의 존재와 호출 권한을 나눌 수 있습니다. 등록되어 있다는 이유만으로 모든 에이전트가 쓰게 하지 않고, 사용자와 팀, 환경에 따라 허용 도구를 좁힐 수 있습니다.

런타임은 실행 경계로 분리

공식 Quickstart는 에이전트에 MCP 도구를 연결하고, 에이전트 런타임에서 예약·이메일·웹훅 트리거, 서브에이전트 위임, 재사용 가능한 스킬, 샌드박스 코드 실행을 구성하는 흐름을 보여줍니다.

운영 시작 순서는 다음처럼 단순하게 잡을 수 있습니다.

  1. 읽기 전용 MCP 도구 하나 등록
  2. 테스트 팀과 별도 환경에 에이전트 생성
  3. 모델·도구·파일 권한을 최소 범위로 제한
  4. 호출 결과와 비용을 관측
  5. 승인 뒤에 쓰기·코드 실행 권한 추가

관측은 통과 판정이 아니다

Archestra는 OpenTelemetry traces와 Prometheus metrics, 로그와 팀별 비용 추적을 기능으로 제시합니다. 이 정보는 에이전트가 무엇을 했는지 확인하는 재료이지, 결과가 항상 올바르다는 보증은 아닙니다.

에이전트 운영 체크리스트에는 호출 성공뿐 아니라 다음을 넣어야 합니다.

  • 허용되지 않은 도구 호출 여부
  • 외부로 전달된 데이터
  • 예상보다 긴 실행과 비용
  • 사람이 승인해야 하는 변경
  • 실패 뒤 재시도와 중복 실행

적용 판단

Archestra의 핵심은 에이전트를 더 자율적으로 만드는 데 있지 않습니다. 모델, 도구, 권한, 실행 환경, 관측을 분리해 자율성이 커져도 통제 지점을 잃지 않는 데 있습니다. 작은 Docker 환경에서 읽기 전용 MCP 하나로 시작하고, 실제 권한 경계를 확인한 뒤 범위를 넓히는 접근이 현실적입니다.