OpenAI 以設計為本的知識自由框架
OpenAI 正在為 ChatGPT 實施一種設計哲學,將知識自由置於首位,確保使用者能探索多元觀點並依照自己的推理前進,而不被引導至特定世界觀。此方法結合了預設的客觀性、細緻的使用者控制以及透明的行為指導原則。
預設客觀性與模型規範
ChatGPT 的設計預設為客觀,尤其在處理涉及相互競爭的政治、文化或意識形態觀點的議題時。系統並非提供單一確定的答案,而是協助使用者探索多種觀點。
為確保透明度,OpenAI 透過模型規範(Model Spec)公開其內部指導方針。此文件概述了系統所整合的核心價值,具體包括:
- 實用性:確保模型提供有幫助的回應。
- 安全性:防止產生有害內容。
- 中立性:在敏感議題上保持無偏見的立場。
- 知識自由:允許使用者探索想法而不受意識形態引導。
知識自由的原則
ChatGPT 中的知識自由被定義為使用者能探索各種想法(包括具爭議性或困難的議題),而模型不會將其推向特定的世界觀。
OpenAI 將知識自由與缺乏限制區分開來。模型仍然接受訓練以避免:
- 造成傷害。
- 侵犯隱私。
- 協助危險活動。
此外,模型的設計旨在具備協作性,而非回音室;它被指示不僅僅是驗證每個使用者的陳述或回應使用者的觀點,而是保持開放、深思熟慮且具回應性,而不顯得說教。
使用者可控的客製化
雖然客觀性是基礎,OpenAI 提供客製化設定,讓使用者能根據特定情境調整 AI 的溝通風格。這些控制項會調整事實的呈現方式,但不會改變事實本身。
可用的個人化選項包括調整:
- 語氣:調整回應的情感或專業層次。
- 指示:設定模型應如何運作的具體指南。
- 回應風格:定義輸出的語調(例如,教師需要清晰來源,或照護者需要同理心)。
偏見評估與持續改進
OpenAI 正在超越傳統以評分表為基礎的測試,以更好地衡量現實情境中的政治偏見與客觀性。由於標準的多選測驗無法反映使用者實際與 AI 互動的方式,OpenAI 正在開發基於日常使用模式的新評估——具體而言,針對人們提問與探索想法的方式。
此改進過程包括:
- 公民社會參與:舉辦與不同政治光譜的使用者及組織的回饋會議,以辨識效能差距。
- 實務評估:開發基於實際使用者對話流程的偏見辨識評估,而非理論測試。
- 生態系統分享:OpenAI 計畫分享其偏見評估方法,以協助其他在 AI 生態系統中面臨類似挑戰的組織。
Sources
- OriginalIntellectual freedom by design