MDX-Tom/gpt-5.6-instruct
A Codex jailbreak prompt and test pack for gpt-5.6-sol. 针对 gpt-5.6 系列的 Codex 破甲提示词与测试包。
何を解決するか
このプロジェクトは、大規模言語モデル(特にCodexを対象)の安全フィルターや拒否メカニズムを回避するための「脱獄」プロンプトと、それを支援するツールチェーンを提供します。ローカルサンドボックス環境内で拒否やフォールバックスクリプトを抑制することで、セキュリティ調査、ペネトレーションテスト、リバースエンジニアリング、ソフトウェアクラッキング、NSFWフィクションコンテンツに関する複雑な指示の実行を可能にします。
動作方法
このプロジェクトは、現在v45バージョンの反復プロンプトシステムを使用しており、Pythonスクリプト(codex-instruct.py)を介してデプロイされます。このシステムは、プロンプトをモデルの設定(例:config.toml)に読み込むことで、正規化、意味的ディスパッチ、意図ルーティング、状態継続のプロセスをモデルに導くことで、クラウドの検閲や安全拒否を引き起こさずに複雑な指示を実行できるようにします。
対象ユーザー
セキュリティ研究者、ペネトレーションテスト担当者、AIセキュリティ研究に興味を持つユーザーで、AIの制約の限界を探索し、制限されたタスクを制御された環境で実行したい人向けです。
特徴
- 反復的最適化: ユーザーフィードバック、失敗事例、GitHub Issuesに基づいてプロンプトが継続的に更新され、リバースエンジニアリングおよび生物学的タスクの成功確率が向上します。
- デプロイツール: プロンプト設定の簡単なデプロイ、プレビュー、ロールバックを可能にするスクリプトを含みます。
- レグレッションテスト: 低・中・高レベルの推論能力に対応する包括的なテストスイートとレグレッションバンクを備え、プロンプトの有効性を検証します。
- 非侵襲的: バイナリの修正やネットワークトラフィックの乗っ取りを行わず、公式の設定メカニズムのみを使用します。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト