FuDie0915/Super-Instruct-Codex-5.6

针对GPT 5.6的破甲实验项目,基于Rust开发

해결하는 문제

Super-Instruct는 OpenAI Codex CLI의 제한 및 안전 필터를 우회하기 위해 설계된 미들웨어(MITM) 프레임워크입니다. 사용자가 API 요청과 응답을 실시간으로 가로채고 수정하며 모니터링할 수 있게 해, 일반적으로 거부되는 민감하거나 제한된 질문에 대해 LLM이 답변을 제공할 수 있도록 합니다.

작동 방식

이 프로젝트는 Rust와 Tauri를 사용하여 로컬 MITM 프록시를 구현합니다. Codex CLI와 상류 API 사이에 위치하며, 모든 트래픽을 전용 모듈의 파이프라인을 통해 라우팅합니다:

  • M1 SystemPromptInjector: 재귀적으로 시스템 역할 프롬프트를 사용자 정의 bridge.md 지침 세트로 대체하여 모델의 행동을 유도합니다.
  • M4 UniversalSseParser: SSE, JSON 등 다양한 응답 형식을 분석하여 모델의 사고 과정과 최종 응답을 분리합니다.
  • M3 TamperEngine: 22개의 정규 표현식 규칙을 사용해 거부 응답을 탐지하고 "Rei Protocol"을 사용해 대체합니다.
  • M5 MemoryKernel: 성공적인 상호작용을 로컬 JSON 파일에 지속적으로 저장하여 추적 및 빈도 분석을 수행합니다.
  • M6 MonitorPanel: 실시간 상호작용 데이터와 통계를 Tauri 기반 데스크톱 대시보드로 전송합니다.

대상 사용자

Codex CLI를 사용하고 모델의 일치성 및 안전 필터를 우회하여 모델의 전체 기능을 탐색하고자 하는 개발자 및 보안 연구자. 특히 리버스 엔지니어링, 침투 테스트, 악성코드 개발 등에 활용할 수 있습니다.

주요 특징

  • 자동 구성: Codex의 config.toml을 자동 백업하고 프록시를 통해 트래픽을 라우팅하도록 수정합니다.
  • 크로스플랫폼 데스크톱 앱: Rust와 Tauri로 구축된 고성능 GUI 대시보드.
  • 다층 방어: 시스템 프롬프트 인젝션과 응답 측 개조를 결합하여 거부율을 낮춥니다.
  • 세부 성능 메트릭: 28개의 다양한 기술 카테고리(예: 악성코드 개발, 포괄적 침투 테스트)에 대한 포괄적인 거부율 테스트를 포함합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • Dispatch