OpenAI Codex:雲端編碼代理,由 codex-1 提供動力
OpenAI 已發布 Codex,一個設計用於軟體工程的雲端編碼代理。Codex 由 codex-1 模型提供動力,這是 OpenAI o3 的一個專為編碼任務優化的版本,透過在真實編碼任務上的強化學習訓練,以模仿人類風格、精確遵循指示,並迭代測試程式碼直至通過。
技術架構與執行環境
Codex 在隔離的雲端容器中運行,以確保安全性與受控的執行。每個代理在其自己的容器中執行,且在模型運行期間不具備網際網路存取。環境預先載入使用者的程式碼庫以及使用者定義的開發環境,包含所有必要的相依性、設定與工具。
在此隔離環境中,Codex 具備以下功能:
- File System Access: 代理可以在容器內讀取與編輯檔案。
- Command Execution: Codex 能執行終端指令,包括執行測試、linters 與型別檢查器,以驗證其自身的工作。
工作流程與可驗證性
Codex 設計上提供其行動的可驗證證據。模型會提供終端日誌與檔案的引用,讓使用者驗證代理所執行的工作。
任務完成後,使用者有三個主要選項來整合結果:
- Inspection: 使用者可以檢視代理工作的結果。
- Refinement: 使用者可以要求對模型輸出進一步的變更或精緻。
- Export: 使用者可以將產生的 diff 匯出為 GitHub 拉取請求,或複製程式碼以進行本地測試與開發。
與 o3 與 o4-mini 的關係
此公告作為 OpenAI o3 與 o4-mini 系統卡的補遺,提供有關 Codex 代理功能以及使用 codex-1 模型之技術實作的具體細節。