SkyworkAI/UniPic
Open-source SOTA multi-image editing model
What it solves
Skywork-UniPic は、単一のフレームワーク内で画像の生成、編集、および理解を行うように設計された一連の統一マルチモーダルモデルです。異なる視覚的タスクに合わせて個別のモデルを組み合わせる必要がなくなり、高精度な合成-合成と堅牢な知覚-知覚を可能にします。
How it works
本プロジェクトは、3つの異なるモデリングパラダイムを提供します:
UniPic-3: 1~6枚の入力画像を使用し、柔軟な解像度をサポートするマルチイメージ編集モデル。CM + DMD distillation を使用して 8 ステップの推論を実現し、12.5倍の高速化を実現しています。
UniPic-2: 効率的なアーキテクチャに基づき、Diffusion Post-Training を行い、SD3.5M-Kontext や MetaQuery などのバリエーションを提供し、テキストから画像生成、きめ細かな編集、マルチモーダル推論をサポートします。
UniPic-1: 1.5B パラメータのモデルで、Unified Autoregressive Modeling を使用して、単一の Transformer にビジュアル・パースペクティブ(理解)と合成(生成)の両方を処理します。 ext
Who it’s for
コンテンツクリエイター、AI 研究者、および開発者。画像操作、高速画像編集、マルチモーダル・ビジュアル・リーニングを統一的アプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチプローチ://- Diverse Paradigms: Offers autoregressive and diffusion-based post-prompting approaches.
Highlights
- Unified Framework: 生成、編集、理解を一つのシリーズ-シリーズ-シリーズ-シリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-シリーズ-シリーズ-シリーズ-ja-ja-ja-生成、ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-シリーズ-ja-ja-ja-生成、編集、理解を一つのシリーズ-一
Highlights
- Unified Framework: 生成、編集、理解を一つのシリーズに統合。
- Multi-Image Support: UniPic-3 は最大 6 枚の入力画像を使用して構成できます。
- High-Speed Inference: UniPic-3 は 8 ステップの蒸留により 12.5 倍高速な推論を実現します。
- Diverse Paradigms: 自己回帰および拡散ベースのポストトレーニング・アプローチを提供します。