ChatGPT 如何學習並保護使用者隱私

OpenAI 結合公開資料、合作夥伴以及使用者產生的內容來訓練 ChatGPT,使用 OpenAI Privacy Filter 來遮蔽個人資訊,並為使用者提供細緻的控制選項,以選擇不參與模型改進。

模型訓練的資料來源

ChatGPT 透過多樣化的資訊來源進行訓練,以建立通用的世界知識並提升可靠性與安全性。這些來源包括:

  • 公開可取得的資訊: OpenAI 使用在網路上自由公開可取得的內容,例如公開部落格文章和線上討論論壇。
  • 合作夥伴: 透過策略性合作夥伴取得的資料。
  • 使用者與研究者貢獻: 由使用者、承包商和研究者提供或產生的資訊。

透過 OpenAI Privacy Filter 減少個人資訊

為防止模型學習個人隱私資訊,OpenAI 在訓練前會對資料集應用防護措施。此流程的主要工具是 OpenAI Privacy Filter,它能辨識並遮蔽文字中的個人資訊。

OpenAI 說明,內部評估顯示 Privacy Filter 在移除個人資訊方面的效果優於任何其他類似工具。此過濾器已整合到訓練管線的多個階段,適用於公開資料集和使用者對話(前提是使用者已啟用「為所有人改進模型」設定)。

ChatGPT 中的使用者隱私控制

OpenAI 提供多種機制,讓使用者控制其資料的處理方式以及是否貢獻於未來的模型迭代:

模型訓練選擇退出

使用者可以在 Settings > Data Controls 中停用「為所有人改進模型」設定。當此設定關閉時,新的對話仍會儲存於聊天記錄,但不會用於訓練 ChatGPT。

暫時聊天

暫時聊天提供以會話為基礎的隱私模式。這些對話:

  • 不會出現在聊天記錄中。
  • 不會建立記憶。
  • 不會用於改進 OpenAI 模型。
  • 為安全目的將保留 30 天,之後刪除。

記憶管理

記憶功能使 ChatGPT 能在不同會話中記住特定細節。這完全是可選的;使用者可以檢閱、編輯或刪除特定記憶,或完全停用該功能,以防止 ChatGPT 保存或參考過去的互動。

帳戶與資料管理

使用者可以透過隱私請求入口提交隱私請求、匯出其 ChatGPT 資料,或完全刪除帳戶。OpenAI 建議使用者不要在 ChatGPT 中分享他們不願被檢閱或使用的敏感資訊。

平衡隱私與安全

OpenAI 堅持認為保護隱私與應對傷害風險必須同時進行。公司持續開發系統來偵測並回應可信的暴力威脅,同時維持現有的隱私防護措施。隨著模型能力提升,OpenAI 承諾改進防護措施,並提供更清晰、更實用的方式,讓使用者決定其資訊如何被使用。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch