OpenAI 更新 GPT-5.6 Sol 並擴大 GPT-5.6 Luna 的使用權限

GPT-5.6 Sol:增強可靠性與使用者控制權

OpenAI 已更新 GPT-5.6 Sol,為 Plus 與 Pro 使用者提供更專注的回答與更高的事實準確度。此次更新旨在減少不必要的格式與細節,確保在處理簡單查詢時回答直接,而在處理如多步驟規劃與研究等複雜任務時則能提供詳盡內容。

提高事實準確度

更新後的 GPT-5.6 Sol 特別針對減少涉及日期、數字、來源與規則的回答錯誤進行了工程設計。針對金融、醫療與法律提示詞的內部評估顯示,與 GPT-5.5 Instant 相比,事實錯誤顯著減少:

  • GPT-5.6 Sol: 包含至少一個事實錯誤的回答減少了 68%
  • GPT-5.6 Luna: 包含至少一個事實錯誤的回答減少了 62%

動態推理控制

Plus 與 Pro 使用者現在可以在網頁、行動裝置與桌面介面上使用推理滑桿。這讓使用者可以手動控制模型在回答時投入的「思考」量,範圍從處理日常問題的「Instant」模式,到用於程式碼編寫、寫作與複雜決策的高強度推理。這種整合確保了無論選擇哪種推理層級,其語氣與行為都能保持一致。

為免費使用者擴大使用權限

Free 與 Go 使用者正轉向以 GPT-5.6 Luna 作為其預設模型。這次轉變包含了能力的重大擴張,旨在讓高智能模型更易於取得。

無限制的文字聊天與推理

從下週開始,Free 使用者將可以使用 GPT-5.6 Luna 進行無限制的文字聊天。為了處理更困難的問題,系統引入了新的 "Think" 按鈕,讓模型有更多時間來處理並推理出複雜的答案。然而,對於圖像生成、檔案上傳及其他專業工具,仍設有使用限制。

部署與安全限制

可用性與範圍

更新後的 GPT-5.6 Sol 可立即供 Plus 與 Pro 使用者使用,但僅限於 ChatGPT Chat 體驗中。驅動 Work 與 Codex 的 GPT-5.6 Sol 版本在此次發佈中保持不變。

青少年的安全性

OpenAI 已針對 18 歲以下的使用者引入了特定的安全訓練,包括:

  • 禁止浪漫角色扮演,以及將 AI 呈現為現實世界關係的替代品。
  • 針對性內容、飲食障礙、身體意象風險與血腥暴力實施界限。
  • 鼓勵青少年在需要支持時與值得信賴的成年人聯繫。

社群觀點與技術分析

產業觀察家與 Hacker News 上的使用者對這些更新的影響提出了幾點看法,範圍從市場策略到技術權衡。

市場商品化與策略

一些分析師指出,向免費使用者提供如 Luna 等強大模型的無限制存取權,顯示了 LLM 市場中的「商品化壓力」。

"I expect a few things to happen in the next year: 1) Exclusive MCP server deals/API integrations 2) Significant switch to B2B marketing... with API interfaces being paid and chat-client interfaces becoming more and more free."

其他人則認為,這是一個增加市場份額並向先前可能僅使用 "instant" 模式的普通使用者展示推理模型的真實能力的策略性舉動。

技術與 UX 疑慮

使用者對模型版本控制的清晰度與使用者介面提出了疑慮:

  • 模型混淆: 一些使用者注意到,在 Chat 與 Work/Codex 中使用不同版本的 "GPT-5.6 Sol" 會造成混淆。
  • UX Bug: 有關於輸入框中自動格式化功能錯誤的報告已出現,部分使用者聲表示稱這模仿了 Claude 但缺乏關閉它的切換開關。
  • 分級爭議: 在進階使用者之間存在爭議,討論 GPT-5.6 Luna 是否代表了免費使用者的真正升級,有人建議它可能是一個比之前的 mini-tier 更有能力的 "nano-equivalent" 模型,儘管增加了 "Think" 按鈕。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch