NVlabs/AnyFlow

Flow Map OPD for AnyStep Video Diffusion

何を解決するか

従来の蒸留された動画拡散モデルは、しばしば固定されたサンプリングステップ数に縛られており、異なる計算リソースに適応できません。AnyFlowは、単一のモデルで任意のステップ数を使用して高品質な動画を生成できるようにすることで、この問題を解決します。ステップ数を増やすにつれて品質が安定して向上します。

仕組み

AnyFlowは、フローマップに基づく動画拡散フレームワークです。オンポリシーのフローマップ蒸留を活用し、任意ステップ生成を可能にしています。このフレームワークは、因果的および双方向の動画拡散アーキテクチャの両方と互換性があり、1.3Bから14Bのパラメータにスケーリング可能です。

対象ユーザー

動画生成モデルの研究者や開発者で、推論速度と品質のトレードオフにおいて柔軟性を求める方々に最適です。

特徴

  • 任意ステップ生成: 固定されたステップ数に縛られず、任意の推論予算に対応可能。
  • 多様なタスク対応: 単一の因果モデル内でテキストから動画、画像から動画、動画から動画の生成をサポート。
  • アーキテクチャに依存しない: 因果的および双方向の動画拡散モデルの両方と互換性あり。
  • スケーラブル: 1.3Bから14Bのパラメータ規模にわたり検証済み。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト