GPT-5 系統卡片附錄:敏感對話

GPT-5 系統卡片附錄:敏感對話 OpenAI 已更新 GPT-5,以更好地識別和支援處於情緒困境中的使用者,透過與超過 170 位心理健康專家合作,將次佳回應減少 65-80%。

GPT-5 系統卡片附錄:敏感對話

OpenAI 已發布 GPT-5 系統卡片的附錄,詳細說明了模型在處理涉及心理和情緒困境的敏感對話時的改進。透過與超過 170 位心理健康專家合作,OpenAI 已將低於預期安全行為的回應減少 65-80%。

模型更新與安全改進

2025 年 10 月 3 日,OpenAI 部署了 ChatGPT 預設模型的更新,以增強其識別困境徵兆的能力並提供具支持性、關懷導向的回應。此更新著重於引導使用者走向真實世界的支援系統,而非在敏感情境下提供不足或不適當的回應。

基線安全評估

為了衡量更新的效果,OpenAI 將 10 月 3 日的模型版本與 ChatGPT 預設模型的 8 月 15 日版本(稱為 GPT-5 Instant)進行比較。得到的評估結果作為模型在處理敏感對話時表現改進的基線。

專家合作

安全改進是與超過 170 位心理健康專家合作開發的。此次合作確保了模型的回應更可靠地符合專業標準,以識別和支援正經歷情緒困境的個體。

Sources