腾讯于2025年12月底开源公开了从文本生成基于人体骨骼的3D角色动作的AI模型“HY-Motion 1.0: Scaling Flow Matching Models for 3D Motion Generation”!
HY-Motion 1.0: Scaling Flow Matching Models for 3D Motion Generation
Tencent HY-Motion 1.0 是一系列基于 Diffusion Transformer(DiT)和流匹配,从文本生成3D人体动作的模型。开发者可以通过简单的文本提示生成基于骨骼的3D角色动画,并可直接集成到各种3D动画管线中。本模型系列是首次将基于 DiT 的文本生成动作模型扩展到10亿参数规模,与现有开源模型相比,在指令遵循能力和动作质量方面实现了显著提升。
🔹10亿规模的DiT:成功将流匹配 DiT 扩展到10亿以上参数,并为指令遵循能力和生成动作的质量设定了新的上限。
🔹全阶段训练策略:为了优化物理合理性和语义准确性,业界首个完整具备 Pre-training → SFT → RL 循环的动作生成模型。
🔹全面的类别覆盖:通过业内最全面、经过细致数据管线筛选整理的方式,涵盖6个主要类别的200多种动作类别。
✨We are excited to open-source Tencent HY-Motion 1.0, a billion-parameter text-to-motion model built on the Diffusion Transformer (DiT) architecture and flow matching. Tencent HY-Motion 1.0 empowers developers and individual creators alike by transforming natural language into… pic.twitter.com/I2BNJkyEB3
— Tencent HY (@TencentHunyuan) December 30, 2025
嘛,动作也会变成这样了呢。是不是会变得越来越简单呢。
金之鸡先生公开了使用任意 VRM 模型进行预览的方法,值得关注
预览用 HY-Motion-1.0 生成的动作到任意 VRM 模型
其他详细信息请查看项目页面!
链接
Project Page
Github
Hugging Face
arxiv