OpenAI Canvas 測試版發布:協作寫作與程式編碼介面 for ChatGPT
TL;DR
OpenAI 宣佈 Canvas,這是一個全新的測試版介面,供 ChatGPT 使用,讓使用者與 GPT‑4o 能在寫作與程式編碼專案中協作,具備行內編輯、版本控制與專屬快捷鍵,最初向 Plus 與 Team 用戶開放。
Canvas 是什麼
Canvas 是一個基於 GPT‑4o 的獨立視窗工作區,擴展了傳統聊天體驗。它允許使用者直接編輯文字或程式碼,突出顯示特定區段以獲得聚焦協助,並呼叫各種寫作與程式任務的快捷鍵。當模型偵測到適合的專案,或使用者在提示中加入「use canvas」這句話時,介面會自動開啟。
核心寫作功能
- Suggest edits – GPT‑4o 提供行內建議與回饋。
- Adjust length – 模型可依需求縮短或延長文件。
- Change reading level – 使用者可設定目標讀者層級,從幼稚園到研究所皆可。
- Add final polish – 文法、清晰度與一致性會自動優化。
- Add emojis – 相關的表情符號會被插入以強調重點。
這些工具為寫作者提供保留完整專案上下文的校對體驗,同時仍允許透過返回鍵手動編輯與版本回復。
核心程式編碼功能
- Review code – 行內建議可提升程式碼風格與正確性。
- Add logs – 會插入印出語句以協助除錯。
- Add comments – 會自動產生說明性註解。
- Fix bugs – 偵測到的錯誤會被重新寫入以解決問題。
- Port to a language – 程式碼可在 JavaScript、TypeScript、Python、Java、C++ 與 PHP 之間轉換。
Canvas 透明地追蹤修訂,解決在純聊天流程中追蹤迭代程式碼變更的困難。
模型如何被訓練以協作
OpenAI 微調 GPT‑4o,使其成為能判斷何時開啟 Canvas、何時進行目標編輯、何時重寫整段內容的創意夥伴。訓練內容包括:
- Trigger detection – 透過從 OpenAI o1‑preview 輸出蒸餾而得的合成資料,教導模型在面向專案的提示(例如「Write a blog post about the history of coffee beans」)時開啟 Canvas,同時避免在簡單問答時不必要的觸發。
- Targeted editing vs. rewriting – 模型學會在使用者突出顯示文字時執行精確編輯,否則預設為較廣泛的重寫。
- Inline critique – 模型對文字與程式碼提供逐行回饋。
內部自動化評估在超過 20 項指標上顯示:
- Correct trigger rate: 寫作任務的正確觸發率為 83%,程式編碼任務為 94%,相較於零樣本 GPT‑4o 基線。
- Targeted‑edit improvement: 啟用 Canvas 的 GPT‑4o 比基線提升了 18%。
- Comment quality: 人類評分的準確度提升了 30%,整體品質提升了 16%,相較於基線。
合成資料生成使得快速迭代成為可能,無需依賴大量人工產生的資料集,然而人工評估仍是評估註解品質的關鍵。
可用性與路線圖
Canvas 正處於早期測試階段,現在可在 GPT‑4o 的模型選擇器中選取。推出時間表:
- Today: 目前已向全球 ChatGPT Plus 與 Team 用戶開放。
- Next week: 將向企業與教育客戶提供存取。
- Future: 計畫在測試期結束後向所有免費用戶釋出。
OpenAI 表示 Canvas 是自兩年前 ChatGPT 推出以來的首次重大視覺介面更新,並顯示出向更具互動性、以專案為中心的 AI 工作流程轉變的趨勢。
對使用者與開發者的影響
- Enhanced productivity: 行內編輯與快捷鍵減少在不同 IDE、文字處理器與聊天視窗之間切換的情境。
- Better version control: 返回鍵提供簡易的復原功能,對於迭代式創作工作相當有用。
- More precise assistance: 以突出顯示為導向的提示讓模型更清楚了解編輯的範圍。
- Potential for broader adoption: 透過降低協作寫作與程式編碼的阻礙,Canvas 有望將 ChatGPT 的角色從問答工具擴展為完整功能的共同作者與共同開發者。
未來展望
OpenAI 計畫根據使用者回饋快速迭代 Canvas,加入新快捷鍵、提升編輯透明度,並擴充支援的程式語言範圍。更廣泛的目標是重新思考人與 AI 的互動,使 AI 在創意與技術領域更有用且更易取得。