DALL·E 3 在 ChatGPT Plus 與 Enterprise 中的整合
OpenAI 已發布 DALL·E 3,現在對 ChatGPT Plus 和 Enterprise 使用者開放。此模型在圖像生成方面代表了重大進步,提供了改進的視覺品質、更高的細節以及比其前身更強的能力來遵循複雜且詳細的提示。
提示遵循的技術進展
DALL·E 3 透過使用最先進的圖像說明器為訓練數據生成高品質的文字描述,實現了卓越的提示遵循。透過在這些改進後的說明上進行訓練,模型對使用者提供的說明變得更加關注,從而能夠可靠地渲染複雜細節,例如文字、手部和臉部。
視覺能力與格式
DALL·E 3 生成的圖像在視覺上更為突出且細節更清晰,優於先前版本。該模型支援多種長寬比,包括橫向和縱向兩種方向,使用戶能夠創建符合靈活格式需求的圖像。
安全系統與內容審核
OpenAI 使用多層次的安全系統來防止生成有害圖像,包括成人、暴力或仇恨內容。該系統會在將圖像交付給使用者之前,對初始使用者提示和生成的圖像進行安全檢查。
為進一步完善這些系統,OpenAI 與專家紅隊成員及早期使用者合作,以識別並僅處理覆蓋範圍的缺口。此過程特別針對圖形內容的邊緣案例,例如性愛圖像,並測試模型生成誤導性圖像的能力。
藝術家與公眾人物保護
作為部署準備的一部分,OpenAI 採取了措施來限制模型生成與在世藝術家風格相似的內容或公眾人物圖像的可能性。公司也專注於提升生成圖像中的人口統計代表性。
AI 來源與偵測
OpenAI 正在評估一個內部來源分類器,旨在識別圖像是否由 DALL·E 3 生成。內部評估顯示以下準確率:
- 未修改的圖像: 在識別 DALL·E 生成的圖像時準確率超過 99%。
- 已修改的圖像: 當圖像經歷常見修改時(如 JPEG 壓縮、調整大小、裁剪或疊加真實圖像剪切片),準確率超過 95%。
儘管這些結果很強,OpenAI 指出該分類器目前僅提供生成的可能性,而非明確的結論。此工具是更廣泛努力的一部分,旨在跨 AI 價值鏈協作,幫助使用者區分 AI 生成的視覺內容與真實圖像。