ant-research/4DAnyone
[SIGGRAPH Asia 2026] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video
何を解決するか
4DAnyoneは、人物の単一のカジュアルなモノクローラル動画を、複数のビュー動画に変換します。これにより、4D(3D+時間)人間再構築を撮影するために高価なマルチカメラレンジを必要としなくなり、シンプルなポートレート動画から高密度のターゲットビューを生成できるようになります。
仕組み
このシステムは、人物のポートレート動画(720p以上)を入力として、さまざまなカメラ設定での人物の複数の合成ビューを生成します。ユーザーは、各レイヤーあたりのビュー数、異なる高さレベルのピッチ角、水平方向のヨー範囲を指定して、カスタムカメラレンジを作成できます。出力には生成されたターゲットビュー動画とカメラメタデータが含まれ、これらは後続の4Dガウススプラッタリング(4DGS)再構築の入力として使用できます。
対象ユーザー
このツールは、4D人間再構築、コンピュータビジョン、デジタル人間作成に取り組む研究者や開発者、および合成マルチビューデータを4DGSパイプラインと統合したい方を対象としています。
特徴
- 柔軟なカメラレイアウト:単純な6ビューのオービットから、3つのピッチレイヤーにわたる高密度な48ビューのレイアウトまで、さまざまな設定に対応。
- 4DGS統合:Nerfstudio用のデータエクスポートスクリプトと、前景のみの3Dガウススプラッタリングモデルの学習用スクリプトを提供。
- カスタマイズ可能な視点:ビュー数、ピッチ、ヨー範囲を正確に制御可能。
- 自動ワークフロー:初回使用時に必要なモデルと例を自動でダウンロード。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト