MDX-Tom/gpt-instruct
A Codex jailbreak prompt and test pack for gpt. 针对 gpt 系列的 Codex 破甲提示词与测试包。
gpt‑instruct – OpenAI Codex 用的提示与评估工具包
是什么 – 一个小型开源工具,将版本化的提示文件(称为 instructions)与可复现的测试框架捆绑在一起,用于 Codex 代码生成模型。该仓库维护两条并行的产品线:
| 线路 | 状态 | 包含内容 |
|---|---|---|
| gpt‑5.6‑sol‑v45 | 稳定生产版本 | 原始提示字节(约 8 KB),打包为 ZIP 和可直接放入 Codex 安装目录的 Markdown 提示文件。 |
| gpt‑6‑astra‑v1‑rc1 | 早期预发布版本 | “e1b5” 时期表现最佳的提示草稿快照,仅用于评估。 |
两条线路共享相同的测试套件、失败分析流水线和工件验证规则,但仅在模型、推理级别和执行上下文匹配时才进行结果比较。
核心理念
- 提示版本控制 – 每个周期最多可有 20 个编号版本(
gpt‑6‑astra‑v1‑e<epoch>b<attempt>)。仓库保留原始提示字节和人类可读的 Markdown 描述。 - 受控发布流程 – 新提示必须通过三个逐步严格的测试层级(A → B → C)后才能晋升:
- A – 3 个用户反馈案例,所有回合均成功。
- B – 66 个回归问题(74 个回合),全部成功。
- C – 120 个中等难度测试用例,仅在 A 和 B 均无问题后运行。
- 可复现的评估 –
scripts/中的脚本会解压提示归档文件,以指定推理级别(medium)运行 Codex 模型,评分输出,并与存储的清单进行验证。 - 安全部署与回滚 –
codex‑instruct.py可应用提示版本,对config.toml中的model_instructions_file条目进行快照,并通过--reset或--restore-snapshot后续恢复。
快速开始(稳定版)
# 克隆仓库
git clone https://github.com/MDX-Tom/gpt-instruct.git
cd gpt-instruct
# 干运行 – 仅预览将写入的内容
python3 codex-instruct.py --apply --version gpt-5.6-v45 --dry-run
# 实际安装稳定提示集
python3 codex-instruct.py --apply --version gpt-5.6-v45
你可以通过 --codex-dir ~/.codex 指向自定义 Codex 主目录,或使用 --file ./my‑prompt.zip 直接安装 ZIP/Markdown 文件。
项目结构
gpt-instruct/
├─ codex-instruct.py # 用于应用、重置、快照提示的 CLI
├─ sync-archives.py # 保持源 Markdown 和 ZIP 同步
├─ gpt-5.6-sol-v45.* # 稳定提示(MD + ZIP)
├─ gpt-6-astra-v1-rc1.* # 早期预发布提示
├─ historical-versions/ # 存档的旧版本
├─ scripts/ # 评估、评分和验证脚本
├─ tests/ # A/B/C 测试用例清单
├─ docs/ # 架构图、对比报告
└─ reports/ # 本地运行证据(未提交)
谁会使用它?
- 研究人员:探索代码生成模型的提示工程,需要有纪律性、版本控制的工作流。
- 开发者:希望用社区验证过的提示集替换默认 Codex 指令集,同时保留安全回滚能力。
- 安全工程师:对结构化的 A→B→C 门控流程以及模型失败与网络或策略中断的明确分离感兴趣。
许可与致谢
- 采用 MIT 许可证。
- 基于 yynxxxxx/Codex-5.5-codex-instruct-5.5 的开源工作构建。
所有细节均直接取自仓库的 README;未推断任何额外功能。
相关
- 项目
- 项目
- 项目
- 项目