ChatGPT 插件發布

OpenAI 已在 ChatGPT 中實作了插件的初步支援,使語言模型能夠存取最新資訊、執行計算,並使用第三方服務。此擴充將 ChatGPT 從文字生成引擎轉變為能與外部資料互動並代表使用者執行受限操作的系統。

核心功能與目的

插件充當語言模型的「眼睛與耳朵」,克服靜態訓練資料的固有限制。透過提供過於近期、個人化或特定於訓練語料庫的資訊存取,插件讓 ChatGPT 能夠:

  • Access Real-Time Data: 從網路或特定資料庫取得即時資訊。
  • Perform Computations: 執行精確的數學與技術計算。
  • Execute Actions: 使用第三方服務整合執行安全且受限的任務。

OpenAI 正以迭代方式部署這些工具,先從少數使用者與 ChatGPT Plus 訂閱者開始,以研究實際影響與安全挑戰,然後再擴大至 API 使用者的存取。

第一方插件:瀏覽與程式碼解譯器

OpenAI 已推出兩個主要的內部插件,以增強模型的基礎功能:

網路瀏覽

瀏覽插件允許 ChatGPT 從網路閱讀資訊,擴展其知識超出訓練語料庫的範圍。

  • Technical Implementation: 此插件使用 Bing 搜尋 API,且僅限發出 GET 請求以降低安全風險。它在與 OpenAI 主基礎設施分離的隔離服務中運行。
  • Web Citizenship: 該插件使用使用者代理標記 ChatGPT-User,並遵守 robots.txt 檔案,以尊重內容創作者。
  • Transparency: 系統會引用來源並列出已訪問的網站,讓使用者驗證準確性並給予創作者應有的致謝。

程式碼解譯器

程式碼解譯器為 ChatGPT 提供一個在沙盒、受防火牆保護的執行環境中運行的 Python 直譯器,並具備暫時性的磁碟空間。

  • Functionality: 它支援檔案上傳與下載,使模型能解決量化與質化的數學問題、執行資料分析與視覺化,並在不同格式之間轉換檔案。
  • Safety: 為防止意外副作用,該環境採取嚴格的網路控制,禁用執行程式碼的外部網路存取。

開源檢索插件

OpenAI 已開源一個檢索插件,使 ChatGPT 能在取得授權後存取個人或組織的資訊來源。

  • Mechanism: 此插件利用 OpenAI 向量嵌入,並允許開發者選擇向量資料庫(如 Milvus、Pinecone、Qdrant、Redis、Weaviate 或 Zilliz)來索引與搜尋文件。
  • Security: 由於該插件是自行託管的解決方案,只將結果加入 ChatGPT 會話且不產生外部影響,主要的安全風險集中於資料授權與隱私。

第三方插件生態系統

第三方插件設計為由語言模型根據包含機器可讀功能說明與面向使用者文件的清單檔案來呼叫。

開發流程

開發者透過建立 API(新建、既有或包裝)並提供 OpenAPI 規範與清單檔案來創建插件。當使用者啟用插件時,其文件會作為對話上下文的一部分提供給模型,使模型能判斷何時以及如何呼叫 API。

初始合作夥伴

早期合作夥伴包括 Expedia、FiscalNote、Instacart、KAYAK、Klarna、Milo、OpenTable、Shopify、Slack、Speak、Wolfram 與 Zapier。

安全與社會影響

將語言模型連結至外部工具會帶來重大風險,包括可能的有害或非預期行動、複雜的提示注入,以及資訊濫用。

緩解策略

OpenAI 基於內部與外部的紅隊演練,實施了多項防護措施:

  • Safety-by-Design: 限制高風險插件行為,並提升插件運作時機的透明度。
  • Iterative Deployment: 逐步推出存取,以限制潛在問題的影響範圍。
  • Evaluation Frameworks: 使用開源的 Evals 框架進行安全性與能力評估。

經濟影響

OpenAI 引用研究指出,具備工具存取的語言模型可能比未具備者產生更大的經濟影響,可能加速工作轉型、職位流失與新職位創造。

Sources