Nano Banana Pro (Gemini 3 Pro Image) リリース
Google DeepMindは、開発者にスタジオ品質の画像生成と高度なクリエイティブコントロールを提供する、高忠実度な画像生成および編集モデルであるNano Banana Pro (Gemini 3 Pro Image)をリリースしました。Gemini 3 Proをベースに構築されたこのモデルは、プロフェッショナルな制作向けに設計されており、テキストレンダリングにおける高い精度、堅牢な世界知識、および根拠に基づいたデータ駆動型の出力を提供するためのGoogle Searchとの統合を実現しています。
プロフェッショナルグレードの忠実度とクリエイティブコントロール
Gemini 3 Pro Imageは、照明、カメラ設定、フォーカス、カラーグレーディングを含む、画像の構図や物理特性を精密に制御することを可能にします。プロフェッショナルな制作基準を満たすため、モデルは2Kおよび4K解像度をサポートしています。
一貫性のあるアセット作成のための主な機能は以下の通りです:
- Reference Integration: モデルは、ロゴ、製品画像、リファレンスなどの多様な要素を単一の広告に組み合わせることができます。
- Consistency: 最大5名までの人物の同一性を維持することができます。
- Input Blending: モデルは、最大6枚の高忠実度ショットの統合、または最大14枚の標準的な入力を単一の洗練された出力にブレンドすることをサポートしています。
高度なテキストレンダリングとローカライゼーション
Gemini 3 Pro Imageは、以前の2.5 Flash Imageモデルと比較してテキストレンダリングが大幅に向上しており、画像内に直接統合された、明確で正確なテキストを生成します。この機能により、マーケティング資料や教育コンテンツなどの実用的なアセットの作成に適しています。
生成に加えて、モデルはimage-to-image生成を通じてローカライゼーションのロジックをサポートします。画像の意味的な文脈を把握することで、元の芸術的なスタイルやレイアウトを維持しながら、看板、メニュー、または文書などの要素の言語を変更することができます。
根拠付け(Grounding)と世界知識
より事実に基づいたアセットを生成するために、Gemini 3 Pro Imageは広大な知識ベースを活用し、Google Searchによるグラウンディングを通じてリアルタイムのウェブコンテンツに接続することができます。この統合は、歴史的な地図や生物学的な図解など、高い精度を必要とするアプリケーションに特に有用です。
エコシステムへの統合と安全性
Gemini 3 Pro Imageは、いくつかのチャネルを通じて開発者エコシステムに統合されています:
- Google Antigravity: このエージェンティック開発プラットフォーム上のコーディングエージェントは、コードを書く前にモデルを使用してUIモックアップやビジュアルアセットを生成できます。
- Creative Platforms: モデルはAdobeおよびFigmaに統合されています。
- Developer Access: モデルは、Google AI StudioおよびVertex AI(エンタープライズ向け)のGemini APIを通じて、有料プレビューとして利用可能です。
AI生成メディアの出所を保証するために、Gemini 3 Pro Imageで作成または編集されたすべての画像には、統合されたSynthIDデジタルウォーターマークが含まれています。
モデル比較:Nano Banana vs. Nano Banana Pro
開発者は、特定のニーズに基づいて2つのモデルを選択できます:
- Gemini 2.5 Flash Image (Nano Banana): より高速で低コストな画像生成に最適化されています。
- Gemini 3 Pro Image (Nano Banana Pro): より高品質な画像生成に最適化されており、関連するコストとレイテンシは高くなります。
Sources
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch