OpenAI DALL·E API 公測公告

TL;DR

OpenAI 宣佈 DALL·E 圖像生成 API 現已開放公開測試,讓開發者能在應用程式中嵌入高品質、文字轉圖像的生成功能,並內建安全過濾機制。

公測上線

DALL·E API 今日以公開測試方式上線,讓開發者能透過簡單的 HTTP 端點呼叫服務。公告中還提供了一個 curl 範例請求,可根據自然語言提示產生 1024×1024 的圖像。取得 OpenAI API 金鑰後,開發者即可在數分鐘內使用此 API。

curl https://api.openai.com/v1/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{
    "prompt": "a photo of a happy corgi puppy sitting and facing forward, studio light, longshot",
    "n":1,
    "size":"1024x1024"
   }'

最先進的圖像生成

DALL·E 的核心能力是根據文字描述創建與編輯原始圖像,涵蓋從藝術插畫到寫實場景的各種風格。該模型因能精確遵循自然語言提示而受到讚譽。OpenAI 表示未來的 API 更新將著重於提升圖像品質、延遲、可擴展性以及整體可用性。

內建審核

API 內建自動審核過濾器,可阻擋仇恨符號、血腥畫面及其他不允許的內容。OpenAI 強調,這些防護措施源自於服務超過三百萬 DALL·E 用戶(每日共產生超過四百萬張圖像)所累積的信任與安全經驗。公司承諾持續改進安全性,讓開發者能專注於產品開發。

早期採用者與使用案例

OpenAI 強調了三個已將 DALL·E 整合至其產品的早期客戶:

  • Microsoft Designer – 一款用於社群媒體貼文、邀請函與數位明信片的平面設計工具。Microsoft 亦在 Bing 與 Microsoft Edge 中嵌入 DALL·E,透過「Image Creator」功能在搜尋結果不足時產生圖像。
  • CALA – 被描述為全球首個時尚與生活方式作業系統,CALA 使用 DALL·E 讓使用者能從文字或參考圖像產生設計概念,簡化從構思到電商的工作流程。
  • Mixtiles – 一項照片列印服務,利用 DALL·E API 為牆面展示製作客製化藝術作品,透過創意提示引導使用者捕捉個人回憶或想像場景。

這些範例說明了 DALL·E 如何為創意設計工具與面向消費者的體驗提供動力。

與 OpenAI 更廣泛平台的整合

DALL·E API 是 OpenAI 更大 API 平台的一部分,該平台亦提供語言模型與其他多模態功能的存取。開發者可將 DALL·E 與文字生成模型結合,打造更豐富的多模態應用程式。

未來展望

OpenAI 表示,API 將持續演進,未來計畫提升圖像真實度、生成速度與安全機制。公開測試邀請開發者進行實驗、提供回饋,並共同參與未來版本的路線圖規劃。

Sources