OpenAI Codex: 用於程式碼生成的 GPT-3 後代

OpenAI Codex 是一個生成式 AI 模型,旨在將自然語言意圖轉換為可執行程式碼。透過將自然語言理解與龐大的公開原始碼資料集結合,Codex 允許使用者透過 API 以英文向軟體發出指令,降低程式設計的門檻。

技術基礎與語言支援

OpenAI Codex 是 GPT-3 的後代,透過結合自然語言與來自公開來源的數十億行原始碼進行訓練,這些來源包括公開的 GitHub 儲存庫。儘管該模型在 Python 上最為強大,但它亦精通超過十種其他語言,包括 JavaScript、Go、Perl、PHP、Ruby、Swift、TypeScript 和 Shell。

與 GPT-3 相比,Codex 具備顯著擴展的 Python 代碼記憶體,其記憶體容量為 14KB,而 GPT-3 為 4KB。這使得 Codex 在執行任務時能處理超過三倍的上下文資訊。

能力與程式設計任務

Codex 是一種通用程式設計模型,能夠應用於廣泛的程式設計任務。其主要優勢在於將簡單問題映射到現有的函式庫、API 或函數,這正是 OpenAI 所描述的程式設計中最不有趣的部分。

該模型的關鍵應用包括:

  • Transpilation: 將程式碼從一種語言轉換為另一種語言。

  • Code Explanation: 將程式碼翻譯為自然語言以說明其功能。
  • Code Refactoring: 重構現有程式碼以進行優化。

可及性與部署

OpenAI 正透過 API 以私人 Beta 形式發布 Codex,並在初期期間免費提供。此部署遵循與 GPT-3 相同的安全基礎,包括對應用程式進行審查以及逐步擴展,以了解該技術在真實世界中的影響。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch