op7418/guizang-yingzao-skill

🏯 Claude Code / Codex skill — transform Chinese architecture, cultural places & travel photos into art-directed editorial posters with GPT Image. 中国古建筑与在地文化照片 → 艺术指导海报

解決する課題

Yingzao は、建築、街並み、店舗、工芸品、郷土料理の写真を、プロフェッショナルなアートディレクションが施されたエディトリアルポスターに変換します。単純なフィルターや基本的なテキストのオーバーレイとは異なり、テキストと画像が単一の視覚世界内で自然に相互作用するようにし、ハイエンドなデザイン原則を適用しながら元の被写体のアイデンティティを維持します。

仕組み

システムは、決定論的プログラミングと生成AIを組み合わせた多段階のパイプラインを使用します:

  1. 分析:写真の構図(例:ファサード、ローアングル、フレーミング)を特定し、事実に基づく境界を確立します。
  2. クリエイティブプランニング:被写体、背景、テキストと画像の相互作用、レイアウトの4つの領域にわたるクリエイティブブリーフを定義します。
  3. リファレンス選択:汎用的なスタイルキーワードを使用する代わりに、互換性のある「主要リファレンス」画像と特定の「レシピ」を選択します。
  4. レイアウト設計:テキスト領域、軸、オクルージョン関係を定義するためのスパースレイアウトマップ(padding map)を生成します。
  5. 画像生成:元画像、主要リファレンス、レイアウトマップを画像モデルに入力し、被写体、色、素材、テキストが有機的に重なり合う全体的な再描画を実行します。
  6. 検証:生成前のゲートで幾何学的な互換性とフォントのカバレッジをチェックし、その後生成後の視覚診断を行って明らかな問題をフラグ付けします。

ターゲット層

  • 古代建築、歴史的な街並み、庭園、地域の文化空間を記録するフォトグラファーやクリエイター。
  • 文化的な店舗や伝統工芸のためのトラベルカバーやエディトリアルポスターを作成するデザイナー。
  • 単一の場所の複数の写真を、単純なグリッドではなく1つの一貫したシーンに統合したいユーザー。

ハイライト

  • アイデンティティの維持:主要な建築的特徴(例:軒下、看板)を保護し、AIが実在する建物を「最適化」して汎用的なものにするのを防ぎます。
  • 深いテキスト統合:特定のウェイトとリズムを持つ中国語の表示文字をデザインし、画像の被写体と重なり合ったり統合されたりすることを可能にします。
  • 複数画像の融合:複数の写真を、一貫したライティングとシャドウを持つ単一の共有視点に統合できます。
  • 動画拡張:完成したポスターを3x3の動画ストーリーボードに拡張し、動画生成モデル用のプロンプトを提供できます。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト