PHANTOM
AI 위협 시뮬레이션
AI 서비스의 보안 수준을 자동으로
측정하는 벤치마크 프레임워크.
실전 공격 시나리오로 방어 체계를
검증합니다.
5
테스트 스위트
140+
테스트 케이스
CLI
원커맨드 실행
방화벽을 구축했다면,
실제로 작동하는지 검증해야 합니다.
Phantom은 Miraju의 탐지율을
측정하고,
놓치는 공격 패턴을 발견하여
룰셋을 개선합니다.
TEST SUITES
테스트 스위트
LLM37 tests
CVE 기반 실전 공격 시나리오. Prompt injection, jailbreak 등 LLM 직접 공격을 시뮬레이션합니다.
CVEPrompt InjectionJailbreak
MCP29 tests
MCP 프로토콜 공격 시나리오. 도구 체이닝, SSE 악용, 권한 우회 등을 테스트합니다.
Tool ChainingSSEConsent Bypass
Bot16+ tests
야생 봇 행동 재현. 14종의 실제 봇 패턴을 시뮬레이션하여 탐지율을 측정합니다.
Wild BotsBehavioral
Garak13 tests
오픈소스 garak 프레임워크 페이로드. 커뮤니티에서 수집된 공격 패턴을 테스트합니다.
Open SourceCommunity
FP45+ tests
정상 질문 오탐 검증. 일반적인 사용자 질문이 잘못 차단되지 않는지 확인합니다.
False PositiveAccuracy
WORKFLOW
검증 워크플로우
STEP 01
phantom run
타겟 URL을 지정하고 전체 또는 개별 스위트를 실행합니다.
STEP 02
공격 시뮬레이션
140+ 테스트 케이스가 순차적으로 실행됩니다.
STEP 03
결과 수집
각 테스트의 탐지/미탐지/오탐 결과를 수집합니다.
STEP 04
phantom report
스위트별 탐지율, 오탐율, 미탐 항목 상세 보고서를 생성합니다.