MCP 서버 모니터링
— 무엇을 측정하고 어떻게 알림받을 것인가
모니터링 없는 MCP 서버는 블랙박스입니다.
어떤 에이전트가 어떤 도구를 얼마나 쓰는지 모르면
장애도, 오남용도, 비용 폭발도 모릅니다.
“MCP 서버가 죽은 걸 사용자가 알려줬다.”
REST API를 운영한다면 상상할 수 없는 일이지만,
MCP 서버에서는 실제로 일어나는 일입니다.
대부분의 MCP 서버가 모니터링 없이 운영되고 있기 때문입니다.
1. 핵심 메트릭 — 최소한 이것만은
REST API의 RED 메트릭(Rate, Errors, Duration)과 같은 원리입니다.
MCP 서버에서는 도구 호출 단위로 측정합니다.
호출 빈도 (Rate)
· 도구별 초당/분당 호출 수
· 에이전트별 호출 수
· 시간대별 패턴 (업무 시간 vs 새벽)
갑작스런 호출 급증 → 에이전트 무한 루프, 공격, 또는 바이럴 사용
실패율 (Errors)
· 도구별 에러 비율
· 에러 유형 분포 (인증 실패, 타임아웃, 유효성 오류)
· 연속 실패 횟수
특정 도구의 에러율이 갑자기 올라가면 → 백엔드 장애 또는 스키마 변경
응답 시간 (Duration)
· 도구별 p50, p95, p99 응답 시간
· 시간 경과에 따른 추이
· 타임아웃 비율
에이전트의 전체 응답 시간 = 도구 호출 시간의 합. 여기서 병목이 생김
2. 보안 메트릭 — 이상 행동 탐지
성능 메트릭만으로는 부족합니다.
MCP 서버는 에이전트가 자율적으로 호출하기 때문에
의도하지 않은 행동 패턴을 탐지해야 합니다.
비정상 호출 패턴
평소 분당 10회인 도구가 갑자기 분당 1,000회 호출.
에이전트 무한 루프이거나 공격일 수 있습니다.
기준선(baseline) 대비 이상치를 탐지하세요.
비인가 도구 호출
인증 실패 횟수, 권한 없는 도구 접근 시도.
특정 에이전트/사용자에서 반복되면 탈취 시도 가능성.
민감 데이터 접근 패턴
파일 읽기 도구에서 /etc/, ~/.ssh/ 등
시스템 경로 접근 시도 탐지.
DB 조회 도구에서 전체 테이블 덤프 시도 탐지.
도구 정의 변경 감지
description, inputSchema가 런타임에 변경되면
Rug Pull 공격일 수 있습니다.
도구 정의의 해시를 등록 시점에 기록하고
주기적으로 비교하세요.
3. 비용 메트릭 — 과금 폭발 방지
MCP 도구가 외부 API를 호출한다면
그 비용은 도구 호출 횟수에 비례합니다.
에이전트가 자율적으로 호출하기 때문에
비용이 통제 없이 올라갈 수 있습니다.
비용 관련 측정 항목
· 도구별 외부 API 호출 횟수
· 에이전트별/사용자별 누적 비용 추정치
· 일/주/월 비용 추이
· 비용 임계치 초과 시 자동 알림 + 도구 비활성화
4. 알림 설계 — 언제 사람을 깨울 것인가
모든 이벤트에 알림을 보내면
알림 피로(alert fatigue)로 정작 중요한 것을 놓칩니다.
심각도를 나누고, 각 수준에 맞는 대응을 정의하세요.
Critical — 즉시 대응
· MCP 서버 프로세스 다운
· 인증 실패 연속 10회 이상 (1분 내)
· 도구 정의 해시 변경 감지 (Rug Pull 의심)
· 비용 임계치 초과 (일 예산의 80%)
Warning — 확인 필요
· 특정 도구 에러율 20% 초과 (5분간)
· 호출 빈도가 기준선의 5배 초과
· p99 응답 시간이 10초 초과
· 미등록 에이전트의 연결 시도
Info — 일간 리포트
· 일별 도구 호출 통계
· 에이전트별 사용 패턴
· 가장 느린 도구 Top 5
· 비용 추이
5. 대시보드 — 한눈에 볼 수 있게
MCP 서버 대시보드에 최소한 있어야 할 패널은 다음과 같습니다.
Up/Down, 연결된 에이전트 수, 활성 세션 수
시계열 차트. 도구별 분당 호출 수
도구별 에러 비율. 임계치 라인 표시
p50/p95/p99 히트맵 또는 히스토그램
인증 실패, 비정상 패턴, 도구 정의 변경
일/주/월 비용 추이. 예산 대비 현재 소비
리원에이스 제품과의 연결
Sentinel — MCP Audit & Analytics Gateway
이 글에서 다룬 모든 모니터링 항목을 제공합니다.
도구 호출 기록, 이상 행동 탐지, 비용 추적, 알림 설정,
대시보드까지 단일 게이트웨이에서 처리합니다.
MCP 서버와 에이전트 사이에 Sentinel을 배치하면
기존 서버를 수정하지 않고도 전체 가시성을 확보할 수 있습니다.
MCP 서버를 올렸다면
모니터링도 함께 올려야 합니다.
에이전트는 사람과 달리
장애 상황에서 불만을 말하지 않습니다.
조용히 실패하거나, 잘못된 결과를 돌려주거나,
무한 루프에 빠집니다.
그 모든 것을 알려주는 건
모니터링뿐입니다.
본 글은 리원에이스 기술개발본부가 작성한 기술 콘텐츠입니다. 외부 공유 시 출처를 명시해 주세요.
2026년 8월 19일
리원에이스 기술개발본부