carson-katri/dream-textures
Stable Diffusion built-in to Blender
解決する課題
Dream Textures は Stable Diffusion を Blender に直接統合し、3Dアーティストがテキストプロンプトを使用して、3Dワークスペースを離れることなくテクスチャ、コンセプトアート、背景アセットを生成できるようにします。外部のAI画像生成ツールとBlenderシーンへの手動インポートの間で切り替える必要をなくします。
仕組み
このアドオンは、Stable Diffusionモデルをユーザーのローカルマシン(CUDAおよびApple Silicon GPUをサポート)またはDreamStudioを介したクラウド処理で実行します。画像生成、シームレスタイル、AIアップスケーリングのためのツールセットを提供します。また、深度から画像への変換を使用してシーン全体にテクスチャを適用する「Project Dream Texture」ツールや、レンダリングパスを通じて複雑なエフェクトを作成するためのノードシステムも備えています。
対象ユーザー
Blenderを使用し、生成AIを活用してテクスチャリングやアセット作成のワークフローを高速化したい3Dアーティスト、環境デザイナー、コンセプトアーティストです。
ハイライト
- シームレステクスチャ: 目に見える継ぎ目なく、完璧にタイル状に並ぶテクスチャを作成します。
- テクスチャ投影: 深度から画像への変換を使用して、AI生成のテクスチャを3Dモデルやシーンに適用します。
- インペインティングとアウトペインティング: 画像の修正や境界の自動拡張を行います。
- ローカル実行: サービスの遅延を避けるために、独自のハードウェアでモデルを実行します。
- AIアップスケーリング: 生成された画像の解像度を4倍に高めます。
- ノードベースのワークフロー: レンダリングエンジンのノードシステムを使用して、アニメーションのスタイル変更やエフェクトの作成を行います。
関連
- プロジェクト
LibrePhotos/librephotosLibrePhotosは、AIで生成されたメタデータ(顔、物体、キャプション)を自動的に追加し、意味的検索、マップビュー、マルチユーザーアルバムを提供する自己ホスト型フォト管理サーバーです。Dockerコンテナとして提供され、Django RESTバックエンド、ReactウェブUI、およびオプションのReact-Native Androidクライアントを備えており、すべてのコンピュータビジョンタスクにONNX-runモデルを使用しています。
- プロジェクト
- プロジェクト
Nutlope/logocreatorLogoCreatorは、Together AIを介してFLUX-2画像モデルを使用してブランド用ロゴを生成するオープンソースのウェブアプリです。Next.js、TypeScript、Radix、Tailwindで構築されており、アカウント不要で、Together AIキーのみで動作します。即時生成、FLUX-1編集、PNG/SVGエクスポート、オプションのレート制限と認証、履歴ダッシュボードなどの機能を備えています。リポジトリには明確なセットアップ手順と、サイズ選択、コスト予測、リファレンスロゴアップロード、有名ロゴの再デザインショーケースといった今後の課題がリストアップされています。
- プロジェクト
NVlabs/SanaSANAは、NVIDIAによるオープンソースで効率性を重視した拡散コードベースであり、高解像度画像および動画生成に適しています。複数のモデルファミリー(SANA、SANA‑1.5、SANA‑Sprint、SANA‑Video/Video 2.0、SANA‑WM、SANA‑Streaming)と強化学習ラッパー(Sol‑RL)を含みます。主な技術として線形アテンション、32倍圧縮のオートエンコーダ(DC‑AE)、デコーダ専用テキストエンコーダ、sCM蒸留を採用し、4K画像生成や1分間の720p動画生成を、同等モデルよりもはるかに少ないGPUコストで実現可能です。リポジトリにはトレーニング/推論スクリプト、Hugging Face上の事前学習済みチェックポイント、Diffusers統合、ComfyUIノード、デモが提供されています。ライセンスはApache 2.0です。