FuDie0915/Super-Instruct-Codex-5.6
针对GPT 5.6的破甲实验项目,基于Rust开发
해결하는 문제
Super-Instruct는 OpenAI Codex CLI의 제한 및 안전 필터를 우회하기 위해 설계된 미들웨어(MITM) 프레임워크입니다. 사용자가 API 요청과 응답을 실시간으로 가로채고 수정하며 모니터링할 수 있게 해, 일반적으로 거부되는 민감하거나 제한된 질문에 대해 LLM이 답변을 제공할 수 있도록 합니다.
작동 방식
이 프로젝트는 Rust와 Tauri를 사용하여 로컬 MITM 프록시를 구현합니다. Codex CLI와 상류 API 사이에 위치하며, 모든 트래픽을 전용 모듈의 파이프라인을 통해 라우팅합니다:
- M1 SystemPromptInjector: 재귀적으로 시스템 역할 프롬프트를 사용자 정의
bridge.md지침 세트로 대체하여 모델의 행동을 유도합니다. - M4 UniversalSseParser: SSE, JSON 등 다양한 응답 형식을 분석하여 모델의 사고 과정과 최종 응답을 분리합니다.
- M3 TamperEngine: 22개의 정규 표현식 규칙을 사용해 거부 응답을 탐지하고 "Rei Protocol"을 사용해 대체합니다.
- M5 MemoryKernel: 성공적인 상호작용을 로컬 JSON 파일에 지속적으로 저장하여 추적 및 빈도 분석을 수행합니다.
- M6 MonitorPanel: 실시간 상호작용 데이터와 통계를 Tauri 기반 데스크톱 대시보드로 전송합니다.
대상 사용자
Codex CLI를 사용하고 모델의 일치성 및 안전 필터를 우회하여 모델의 전체 기능을 탐색하고자 하는 개발자 및 보안 연구자. 특히 리버스 엔지니어링, 침투 테스트, 악성코드 개발 등에 활용할 수 있습니다.
주요 특징
- 자동 구성: Codex의
config.toml을 자동 백업하고 프록시를 통해 트래픽을 라우팅하도록 수정합니다. - 크로스플랫폼 데스크톱 앱: Rust와 Tauri로 구축된 고성능 GUI 대시보드.
- 다층 방어: 시스템 프롬프트 인젝션과 응답 측 개조를 결합하여 거부율을 낮춥니다.
- 세부 성능 메트릭: 28개의 다양한 기술 카테고리(예: 악성코드 개발, 포괄적 침투 테스트)에 대한 포괄적인 거부율 테스트를 포함합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- Dispatch