OllamaがZ-Image TurboとFLUX.2 Kleinによる実験的な画像生成機能を追加
TL;DR
OllamaはmacOS向けに実験的な画像生成サポートをリリースしました。Z-Image Turbo(6Bパラメータ、フォトリアルかつバイリンガル)とFLUX.2 Klein(4B/9Bパラメータ、強力なテキストレンダリング)の2つのモデルを公開し、ユーザーがターミナルから直接画像を生成・プレビューできるようになりました。
macOSですぐに利用可能
Ollamaの新しいrunコマンドは、生成された画像を現在の作業ディレクトリに保存します。インライン画像表示をサポートするターミナル(例:Ghostty, iTerm2)を使用すると、結果を即座に表示できます。WindowsおよびLinuxのサポートは将来のリリースで予定されています。
ollama run x/z-image-turbo "your prompt"
Z-Image Turboモデル
Source: AlibabaのTongyi Lab Size: 6Bパラメータ License: Apache 2.0 (オープンウェイト、商用利用可能)
- フォトリアルな出力: 写実的な写真、ポートレート、風景に優れています。
- バイリンガルなテキストレンダリング: 画像内に英語と中国語の文字を正確に描画します。
プロンプトの例と結果
- フォトリアルなポートレート: "Young woman in a cozy coffee shop, natural window lighting, wearing a cream knit sweater, holding a ceramic mug, soft bokeh background…"
- 中国語の書道: "Traditional Chinese calligraphy brush painting style, the characters "山高水长" written in elegant black ink on rice paper…"
- クリエイティブな構成: "Surreal double exposure portrait, woman's silhouette filled with blooming cherry blossom trees…"
すべての例はブログ記事内でインライン表示されており、ollama run x/z-image-turboコマンドを使用して同じプロンプトで再現可能です。
FLUX.2 Kleinモデル
Source: Black Forest Labs Sizes: 4B (Apache 2.0) および 9B (FLUX Non-Commercial License v2.1) Key strength: 生成された画像内の信頼性の高い読み取り可能なテキスト。UIモックアップやタイポグラフィデザインに有用です。
プロンプトの例と結果
- テキストレンダリング: "A neon sign reading "OPEN 24 HOURS" in a rainy city alley at night, reflections on wet pavement."
- プロダクトフォトグラフィー: "Matte black coffee tumbler on wooden desk, morning sunlight casting long shadows, steam rising, commercial product shot."
両方のプロンプトは、複雑なシーンの中に鮮明で判読可能なテキストを配置するモデルの能力を示しています。
設定オプション
Ollamaは、生成を微調整するためのターミナルコマンドを提供します。
- Image location: 画像は現在のディレクトリに書き込まれます。別の場所に保存したい場合は、事前にディレクトリを変更してください。
- Image size:
/set widthと/set heightを使用して寸法を調整できます。サイズが小さいほど生成が速く、メモリ消費も少なくなります。 - Number of steps: 反復回数を制御します。ステップ数が少ないと詳細さは犠牲になりますが生成が速くなります。多すぎるステップはアーティファクト(ノイズ)を発生させる可能性があります。デフォルト値はモデルごとに異なります。
- Random seed: シード値を設定することで再現可能な出力を得ることができ、反復的なデザイン作業を容易にします。
- Negative prompts: モデルが避けるべき不要な要素を指定します。
ロードマップ
- ネイティブな画像生成をWindowsおよびLinuxへ拡張。
- さらに多くのtext-to-imageモデルを追加し、画像編集機能も導入。
All images and prompts shown above are directly taken from Ollama's official blog post dated 2026-01-20.
Sources
- OriginalImage generation (experimental)
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- プロジェクト