ChatGPT Images 2.5 リリースノート / 新機能

OpenAIは、視覚的な忠実度、編集の精度、および生成速度を向上させるために設計された最先端の画像モデル、ChatGPT Images 2.5をリリースしました。このアップデートにより、Images 2.0と比較して画像生成のレイテンシが50%削減され、ユーザーがクリエイティブなプロセスをガイドするための新しいインタラクティブなツールが追加されました。

画像の忠実度とリファレンスの取り扱いの向上

Images 2.5は、被写体の認識性を維持しながら、異なる設定、スタイル、および構成においてリファレンス写真から被写体を変換する能力を強化しています。このモデルは、より自然な照明、より豊かな質感、および特徴的な特徴のより優れた保持を実現し、エンドユーザーとAPI開発者の両方にとって、リファレンス主導のワークフローをより信頼性の高いものにします。

精度とマルチターン編集

Images 2.5における編集はより焦点が絞られており、ユーザーは製品や背景などの特定の要素を修正することなく、画像の他の部分を変更することができます。この精度は複数の会話ターンにわたって維持され、以前の変更が一致し続け、指示がより具体的になるにつれて画像品質が低下しないことを保証します。

知能、スタイル、およびレイアウト

このモデルは、複雑な視覚的指示や現実世界の情報に対する理解が向上しています。主な技術的な改善点は以下の通りです:

  • Complex Layouts: レイアウトの取り扱いが向上し、透明な背景の生成も含まれます。
  • Visual Style Alignment: 要求された芸術的なビジョンやクリエイティブ・ブリーフを反映する精度が向上しました。
  • Content Accuracy: 画像内の現実世界の情報のより正確な表現。

ChatGPTにおける新しいクリエイティブツール

OpenAIは、ユーザーが画像作成をより詳細に制御できるように、いくつかの製品機能を導入しました:

  • Sketch: ユーザーがChatGPT内で直接、ラフなレイアウトや落書きを描くことができる機能(「@Sketch」コマンド経由)で、最終的な画像の視覚的なガイドとして機能します。
  • Templates: 「Poster」や「Merch」など、人気の高いクリエイティブなニーズに対応する定義済みのフォーマットで、ユーザーのプロンプトを構造化するのを助けます。
  • Direct Comments: より焦点の絞られた編集を行うために、画像上に直接コメントを配置する機能。
  • Prompt Sharing: ユーザーは、画像を生成するために使用された特定のプロンプトを共有できるようになり、他のユーザーがアイデアを複製または適応させることができます。

APIモデルのオプション

開発者向けに、OpenAIはAPI経由で2つの異なるモデルをリリースしています:

  • GPT-Image-2.5 Flare: ほとんどのアプリケーション向けのデフォルトの選択肢であり、チャットインターフェースと同じ品質と速度の向上を提供し、GPT-Image-2との比較で50%低いレイテンシを実現します。
  • GPT-Image-2.5 Sunburst: 編集におけるより高い精度とより厳密な制御を必要とするプレミアムな視覚的ワークフローに最適化されたモデルですが、生成時間は長くなります。

安全性と可用性

ChatGPT Images 2.5は、、ChatGPT、ChatGPT Work、およびCodexのすべてのユーザーが、デスクトップ、モバイル、およびウェブで利用可能です。安全性を確保するため、モデルは有害な出力を防止するためにプロンプトと画像のチェックを行い、C2PAメタデータを利用し、不可視のウォーターマーキングを実装しています。詳細な評価はシステムカードで確認できます。

Sources