ChatGPT 鎖定模式與提升風險標籤
OpenAI 推出了鎖定模式以及「提升風險」標籤系統,以保護使用者免受提示注入攻擊並防止未授權的資料外洩。這些工具提供了深層防禦的安全方法,讓高風險使用者與組織能以犧牲部分產品功能為代價,換取更嚴格的防護措施。
鎖定模式:針對高風險使用者的確定性安全
鎖定模式是一項可選的進階安全設定,針對具有較高安全需求的使用者(如主管或安全團隊)設計,以降低基於提示注入的資料外洩風險。啟用後,它會透過確定性地停用或限制特定工具與功能,嚴格限制 ChatGPT 與外部系統的互動方式。
鎖定模式的主要限制
為防止敏感資料在對話之外被分享,鎖定模式會限制或關閉以下功能:
- 即時網路存取:網頁瀏覽僅限於快取內容,確保不會有即時網路請求離開 OpenAI 受控的網路。
- 影像支援:回應中的影像支援已停用。
- 深度研究:包括購物研究功能。
- 代理模式與 Canvas 網路:這些連結功能已停用。
- 即時連接器與檔案下載:這些功能已關閉,以減少提示注入類攻擊的攻擊面。
可用性與管理
鎖定模式最初於 ChatGPT Enterprise、Edu、Healthcare 與 Teachers 計畫推出。自 2026 年 6 月 4 日起,已擴展至個人 ChatGPT 帳號以及自行服務的 ChatGPT Business 帳號。
對於組織管理員而言,鎖定模式會在現有管理設定之上再加一層限制。管理員可透過工作區設定建立新角色來啟用此功能。為了維持關鍵工作流程,管理員仍可細緻控制在鎖定模式下哪些特定應用程式及其內的操作仍可供使用者使用。
提升風險標籤:標準化風險溝通
OpenAI 正在標準化「提升風險」標籤的使用,以在 ChatGPT、ChatGPT Atlas 與 Codex 之間提供一致的指引。這些標籤會套用於可能帶來尚未被業界安全緩解措施完全解決之網路相關風險的功能。
實作與目的
「提升風險」標籤會在使用者啟用可能帶來額外安全風險的功能時(例如在 Codex 中開啟網路存取以查閱文件)提供提示。這讓使用者在處理私人資料時,能就是否使用這些功能作出明智的決策。
OpenAI 表示,當安全技術足以充分降低這些風險以供一般使用時,這些標籤將被移除,且帶有此標籤的功能清單將隨時間持續更新。
深層防禦策略
OpenAI 的安全策略著重於在 AI 系統變得更強大且更具連結性時提供實用的防護。透過結合如鎖定模式等確定性設定與透明的風險標籤,OpenAI 旨在減輕新興的提示注入風險,即第三方試圖誤導 AI 系統洩露敏感資訊或執行惡意指令的情況。