Tencent-Hunyuan/HY-Motion-1.0
HY-Motion model for 3D human motion or 3D character animation generation.
What it solves
HY-Motion 1.0 解決了從文本描述中生成高品質、自然 3D 人體動畫的挑戰。相較於之前的開源模型,它透過增強文本提示詞與生成動作之間的語義對齊,以及提升角色動作的整體平滑度與真實感,實現了進一步的改進。
How it works
該專案利用 Diffusion Transformer (DiT) 架構並結合了 Flow Matching。它將這些模型擴展至十億參數級別,以提升指令遵循能力。訓練過程包含三個階段:
- Large-Scale Pre-training: 從超過 3,000 小時的動作數據中學習廣泛的動作先驗知識。
- High-Quality Fine-tuning: 使用 400 小時精選數據來精煉動作細節與平滑度。
- Reinforcement Learning: 使用人類回饋與獎勵模型來進一步提升動作的自然度與對提示詞的遵循度。
Who it’s for
此工具是為開發者與 3D 動畫師設計的,旨在生成可整合至現有 3D 動畫流程中的基於骨架的 3D 角色動畫。
Highlights
- Billion-Scale Parameters: 首個達到十億參數規模的 DiT 架構文本轉動作模型,可提供更好的指令理解能力。
- Three-Stage Training: 包含預訓練、高品質精細調整與 RLHF 的全面性流程。
- Hunyuan-1.0 and Lite versions: 提供標準的 1.0B 參數模型與輕量化的 0.46B 版本。
- VLM-based Evaluation: 包含 SSAE (Structured Semantic Alignment Evaluation) 用於評估生成動作與文本提示詞的對齊程度。
相關
- 專案
- 專案
- 專案
- Dispatch
- 專案