OpenAI DALL·E API 公測公告
TL;DR
OpenAI 宣佈 DALL·E 圖像生成 API 現已開放公開測試,讓開發者能在應用程式中嵌入高品質、文字轉圖像的生成功能,並內建安全過濾機制。
公測上線
DALL·E API 今日以公開測試方式上線,讓開發者能透過簡單的 HTTP 端點呼叫服務。公告中還提供了一個 curl 範例請求,可根據自然語言提示產生 1024×1024 的圖像。取得 OpenAI API 金鑰後,開發者即可在數分鐘內使用此 API。
curl https://api.openai.com/v1/images/generations \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
"prompt": "a photo of a happy corgi puppy sitting and facing forward, studio light, longshot",
"n":1,
"size":"1024x1024"
}'
最先進的圖像生成
DALL·E 的核心能力是根據文字描述創建與編輯原始圖像,涵蓋從藝術插畫到寫實場景的各種風格。該模型因能精確遵循自然語言提示而受到讚譽。OpenAI 表示未來的 API 更新將著重於提升圖像品質、延遲、可擴展性以及整體可用性。
內建審核
API 內建自動審核過濾器,可阻擋仇恨符號、血腥畫面及其他不允許的內容。OpenAI 強調,這些防護措施源自於服務超過三百萬 DALL·E 用戶(每日共產生超過四百萬張圖像)所累積的信任與安全經驗。公司承諾持續改進安全性,讓開發者能專注於產品開發。
早期採用者與使用案例
OpenAI 強調了三個已將 DALL·E 整合至其產品的早期客戶:
- Microsoft Designer – 一款用於社群媒體貼文、邀請函與數位明信片的平面設計工具。Microsoft 亦在 Bing 與 Microsoft Edge 中嵌入 DALL·E,透過「Image Creator」功能在搜尋結果不足時產生圖像。
- CALA – 被描述為全球首個時尚與生活方式作業系統,CALA 使用 DALL·E 讓使用者能從文字或參考圖像產生設計概念,簡化從構思到電商的工作流程。
- Mixtiles – 一項照片列印服務,利用 DALL·E API 為牆面展示製作客製化藝術作品,透過創意提示引導使用者捕捉個人回憶或想像場景。
這些範例說明了 DALL·E 如何為創意設計工具與面向消費者的體驗提供動力。
與 OpenAI 更廣泛平台的整合
DALL·E API 是 OpenAI 更大 API 平台的一部分,該平台亦提供語言模型與其他多模態功能的存取。開發者可將 DALL·E 與文字生成模型結合,打造更豐富的多模態應用程式。
未來展望
OpenAI 表示,API 將持續演進,未來計畫提升圖像真實度、生成速度與安全機制。公開測試邀請開發者進行實驗、提供回饋,並共同參與未來版本的路線圖規劃。