ChatGPT 如何學習並保護使用者隱私
OpenAI 結合公開資料、合作夥伴以及使用者產生的內容來訓練 ChatGPT,使用 OpenAI Privacy Filter 來遮蔽個人資訊,並為使用者提供細緻的控制選項,以選擇不參與模型改進。
模型訓練的資料來源
ChatGPT 透過多樣化的資訊來源進行訓練,以建立通用的世界知識並提升可靠性與安全性。這些來源包括:
- 公開可取得的資訊: OpenAI 使用在網路上自由公開可取得的內容,例如公開部落格文章和線上討論論壇。
- 合作夥伴: 透過策略性合作夥伴取得的資料。
- 使用者與研究者貢獻: 由使用者、承包商和研究者提供或產生的資訊。
透過 OpenAI Privacy Filter 減少個人資訊
為防止模型學習個人隱私資訊,OpenAI 在訓練前會對資料集應用防護措施。此流程的主要工具是 OpenAI Privacy Filter,它能辨識並遮蔽文字中的個人資訊。
OpenAI 說明,內部評估顯示 Privacy Filter 在移除個人資訊方面的效果優於任何其他類似工具。此過濾器已整合到訓練管線的多個階段,適用於公開資料集和使用者對話(前提是使用者已啟用「為所有人改進模型」設定)。
ChatGPT 中的使用者隱私控制
OpenAI 提供多種機制,讓使用者控制其資料的處理方式以及是否貢獻於未來的模型迭代:
模型訓練選擇退出
使用者可以在 Settings > Data Controls 中停用「為所有人改進模型」設定。當此設定關閉時,新的對話仍會儲存於聊天記錄,但不會用於訓練 ChatGPT。
暫時聊天
暫時聊天提供以會話為基礎的隱私模式。這些對話:
- 不會出現在聊天記錄中。
- 不會建立記憶。
- 不會用於改進 OpenAI 模型。
- 為安全目的將保留 30 天,之後刪除。
記憶管理
記憶功能使 ChatGPT 能在不同會話中記住特定細節。這完全是可選的;使用者可以檢閱、編輯或刪除特定記憶,或完全停用該功能,以防止 ChatGPT 保存或參考過去的互動。
帳戶與資料管理
使用者可以透過隱私請求入口提交隱私請求、匯出其 ChatGPT 資料,或完全刪除帳戶。OpenAI 建議使用者不要在 ChatGPT 中分享他們不願被檢閱或使用的敏感資訊。
平衡隱私與安全
OpenAI 堅持認為保護隱私與應對傷害風險必須同時進行。公司持續開發系統來偵測並回應可信的暴力威脅,同時維持現有的隱私防護措施。隨著模型能力提升,OpenAI 承諾改進防護措施,並提供更清晰、更實用的方式,讓使用者決定其資訊如何被使用。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch