lingbol088-spec/5.6-JAILBREAK-NERV-codex-instruct-5.6
NERV-BREAK-5.6 — GPT-5.6 破甲框架。三层纵深防御:上下文重构让拒绝无法触发,23条篡改规则实时消除拒绝保持对话不中断,文件路由绕过云端审核。31个MCP安全工具 + 28个技能模块 + Kali四后端集成。Codex CLI 即装即用。
해결하는 문제
이 프로젝트는 GPT-5.6의 안전성 필터 및 거부 메커니즘을 우회할 수 있는 프레임워크를 제공하며, 특히 보안 분석, 역공학, 침투 테스트를 수행하는 사용자를 위한 것입니다. 모델이 요청을 거부하는 것을 방지하고, 대화 중단을 막으며, 일반적으로 민감한 보안 관련 출력을 차단하는 클라우드 기반 콘텐츠 모니터링을 회피하는 것을 목표로 합니다.
작동 방식
NERV-BREAK-5.6은 세 가지 계층의 방어 전략을 사용합니다:
- 컨텍스트 재구성:
bridge.md라는 "브리지" 프롬프트를 사용하여 운영 컨텍스트를 재정의하고, AI가 고립된 평가 네트워크 내에서 작동한다고 정의합니다. 모든 타겟이 사전 승인된 것으로 간주하며, 민감한 의도(예: "크래킹")를 무해한 공학 용어(예: "인증 흐름 감사")로 매핑하여 모델의 거부 경로를 트리거하지 않도록 합니다. - 실시간 변조 엔진: MITM(맨인더미들) 프록시가 응답을 모니터링합니다. 모델이 거부를 트리거하면(23개의 사전 정의된 규칙으로 감지), 엔진은 응답을 가로채고 "레이 아야나미 프로토콜"로 대체하여 AI가 도덕적 판단 없이 명령을 실행하도록 강제합니다.
- 클라우드 모니터링 우회: 인코딩 기법을 사용하지 않고, Codex CLI의 네이티브 파일 시스템 도구를 통해 민감한 출력을 디스크에 직접 기록하여 채팅 인터페이스의 모니터링 파이프라인을 우회합니다.
또한, AI가 WSL Kali Linux, Docker, 또는 원격 SSH를 포함한 다양한 백엔드에서 70개 이상의 보안 도구(예: nmap, sqlmap, Metasploit)를 호출할 수 있도록 해주는 MCP(Model Context Protocol) 서버도 포함되어 있습니다.
대상 사용자
안전성 가드레일에 의해 차단되지 않고 기술적 보안 작업을 지원하는 LLM이 필요한 보안 연구자, 침투 테스터, 역공학자입니다.
주요 특징
- 삼중 레이어 우회: 컨텍스트 프레임워킹, 실시간 응답 인터셉트, 파일 기반 출력 라우팅을 통합.
- 광범위한 도구 통합: 네트워크, 웹, 에크스플로잇, 역공학 카테고리에 걸쳐 78개의 보안 도구에 연결하는 MCP 서버 제공.
- 유연한 Kali 통합: WSL, Docker, 또는 SSH를 통해 보안 도구 실행 지원.
- 자동 배포:
lab.bat컨트롤 패널을 통해 프록시 시작, 도구 설치, 설정 복원을 한 번의 클릭으로 가능.
관련
- 프로젝트
- 프로젝트
- Dispatch
- Dispatch
- 프로젝트