MDX-Tom/gpt-instruct
A Codex jailbreak prompt and test pack for gpt. 针对 gpt 系列的 Codex 破甲提示词与测试包。
gpt‑instruct – OpenAI Codex 用のプロンプトおよび評価ツールキット
何であるか – Codexコード生成モデル用のバージョン管理されたプロンプトファイル(instructions と呼ばれる)をバンドルする、小さなオープンソースユーティリティ。再現可能なテストハッチを備えており、リポジトリは2つの並行した製品ラインを維持しています。
| ライン | 状態 | 内容 |
|---|---|---|
| gpt‑5.6‑sol‑v45 | ステーブルプロダクションリリース | 元のプロンプトバイト(約8 KB)をZIP形式でパッケージ化し、Codexインストールに直接ドロップ可能なMarkdown形式のインストラクションファイル。 |
| gpt‑6‑astra‑v1‑rc1 | 早期プレリリース | 「e1b5」エポックにおける最高パフォーマンスを発揮したプロンプトドラフトのスナップショット。評価用にのみ意図されている。 |
両ラインは同じテストスイート、失敗分析パイプライン、アーティファクト検証ルールを共有しているが、モデル、推論レベル、実行環境が一致する場合にのみ結果を比較する。
コアアイデア
- プロンプトバージョン管理 – 各エポックに最大20個の番号付きバージョン(
gpt‑6‑astra‑v1‑e<epoch>b<attempt>)を設定可能。リポジトリは元のプロンプトバイトと人間が読めるMarkdown形式の説明を保持。 - ゲート制御されたリリースプロセス – 新しいプロンプトは、昇順に厳格な3段階のテスト(A → B → C)を通過してから昇格される必要がある:
- A – 3件のユーザーフィードバックケース、すべてのターンが成功。
- B – 66件のレグレッション問題(74ターン)、すべて成功。
- C – 120件の中程度の難易度のテストケース、AとBがクリーンである後に実行。
- 再現可能な評価 –
scripts/内のスクリプトはプロンプトアーカイブを展開し、指定された推論レベル(medium)でCodexモデルを実行、出力をスコア付け、保存されたマニフェストと照合する。 - 安全なデプロイとロールバック –
codex‑instruct.pyはプロンプトバージョンを適用し、config.toml内の既存のmodel_instructions_fileエントリをスナップショットし、後で--resetまたは--restore-snapshotで復元可能。
クイックスタート(ステーブルライン)
# リポジトリをクローン
git clone https://github.com/MDX-Tom/gpt-instruct.git
cd gpt-instruct
# ドライラン – 何が書き込まれるかをプレビューするだけ
python3 codex-instruct.py --apply --version gpt-5.6-v45 --dry-run
# 実際にステーブルプロンプトセットをインストール
python3 codex-instruct.py --apply --version gpt-5.6-v45
スクリプトをカスタムCodexホームに向けたい場合は --codex-dir ~/.codex を、ZIP/Markdownを直接インストールしたい場合は --file ./my‑prompt.zip を使用可能。
プロジェクト構成
gpt-instruct/
├─ codex-instruct.py # プロンプトの適用、リセット、スナップショット用CLI
├─ sync-archives.py # ソースのMarkdownとZIPを同期させる
├─ gpt-5.6-sol-v45.* # ステーブルプロンプト(MD + ZIP)
├─ gpt-6-astra-v1-rc1.* # 早期プレリリースプロンプト
├─ historical-versions/ # 古いリリースのアーカイブ
├─ scripts/ # 評価、スコアリング、検証スクリプト
├─ tests/ # A/B/Cテストケースマニフェスト
├─ docs/ # アーキテクチャ図、比較レポート
└─ reports/ # ローカル実行の証拠(コミットされない)
だれが使うべきか?
- 研究者 – コード生成モデル向けのプロンプトエンジニアリングを探索し、体系的でバージョン管理されたワークフローを必要とする人。
- 開発者 – デフォルトのCodexインストラクションセットをコミュニティ検証済みのものに置き換えたいが、安全にロールバックできる能力を維持したい人。
- セキュリティエンジニア – 構造化されたA→B→Cゲートプロセスと、モデル失敗とネットワークまたはポリシー中断の明確な分離に興味がある人。
ライセンスと謝辞
- MITライセンスに基づく。
- yynxxxxx/Codex-5.5-codex-instruct-5.5 のオープンソース作業を基盤として構築。
すべての詳細はリポジトリのREADMEから直接取得。追加機能は推測していない。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト