CyberSunil/LLMVault

An intentionally vulnerable OWASP LLM Top 10 training platform for AI Security, Prompt Injection, RAG Security, Agent Security, and GenAI penetration testing.

해결하는 문제

LLMVault은 개발자와 보안 연구자가 OWASP Top 10 for LLM Applications에 대해 실습적으로 학습할 수 있는 안전한 환경을 제공합니다. 실제 운영 시스템에 위험을 주지 않고도 공통적인 AI 취약점을 공격하고 방어하는 연습이 가능한 '캡처 더 플래그'(CTF) 스타일의 교육 환경이 부족한 문제를 해결합니다.

작동 방식

이 플랫폼은 두 가지 별개의 모드로 작동합니다:

  • 플레이 모드: 3단계(코어, 고급, 전문가)로 나뉘어진 총 25개의 랩을 포함한 점수 기반의 훈련 범위입니다. 각 랩은 스크립트화된 어시스턴트를 사용해 재현 가능한 결과를 보장하며, 사용자가 특정 기술을 몸에 익힐 때까지 반복 연습할 수 있습니다.
  • 라이브 모드: Ollama 또는 OpenAI 호환 엔드포인트를 통해 실제 로컬 LLM에 연결합니다. 이 모드에서는 세션마다 새로운 시크릿이 생성되며, 모델의 예측 불가능한 성질로 인해 사용자는 진정으로 AI를 조작해 정보를 유출해야 합니다.

시스템은 Flask로 구축되었으며 Docker를 통해 배포할 수 있습니다. 진행 상황 추적을 위한 대시보드, 플레이 모드용 스코어링 시스템, 각 랩 전후에 OWASP 카테고리 설명과 완료 후 필요한 수정 방법을 제공하는 통합 참조 패널이 포함되어 있습니다.

대상 사용자

프롬프트 인젝션, 데이터 풀림, 과도한 자율성과 같은 LLM 고유의 보안 위험을 식별하고 공격하며 완화하는 방법을 배우고자 하는 보안 교육자, 개발자, AI 전문가를 위한 것입니다.

주요 특징

  • 단계적 학습 경로: 10개의 코어 OWASP 랩에서 시작해 10개의 고급 다단계 대화형 도전과제, 5개의 암호화된 전문가 랩으로 이어집니다.
  • 실제 모델 통합: 라이브 모드에서는 실제 로컬 모델(예: Qwen 2.5)을 대상으로 테스트할 수 있어 예측 불가능한 AI 행동을 경험할 수 있습니다.
  • 포괄적인 커버리지: 멀티모달 간접 인젝션과 하류 출력 처리를 포함한 OWASP LLM Top 10 전체를 다룹니다.
  • 통합 교육: 모든 공격 시나리오에 대해 방어 방법과 수정 방법에 대한 상세 설명을 제공합니다.
  • 게임화된 경험: 스코어링 시스템, 랭크(초보자에서 밸트 마스터까지), 공유 가능한 완료 카드를 제공합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트