混元多模态-Motion动作生成大模型研究
关于这个机会
课题背景: 虚拟现实、游戏、数字内容创作、具身智能等领域,高质量、多样化的3D人体动作生成技术已成为行业核心需求,在动作生成、视频动作捕捉、人体姿态估计、动作过渡生成、动作重定向等方面存在很多技术挑战。本课题致力于研发能够生成高质量、高真实感的动作大模型,打造行业影响力,赋能相关领域的发展。 课题挑战: 1、生成的动作质量低:现有模型生成的动画普遍存在抖动、滑步、肢体运动不符合物理规律等问题,难以满足工业应用的流畅性要求; 2、细节与真实感缺失:动作的力量感、关节联动、发力及传递等细节难以还原,导致数字人表现力不足; 3、物理仿真与动作解耦困难:现有方法难以在动作生成中动态平衡物理约束与艺术表达形态美观的需求,导致动作僵硬或不自然; 4、重定向导致动作品质下降:现有重定向工具在没有美术人员人工介入的情况下会导致动作品质下降,难以满足下游应用的要求。 具体工作: 入选同学将参与到混元Motion系列大模型的研发,具体包括动作生成、视频动作捕捉、人体姿态估计、动作过渡生成、动作重定向、动作物理优化等技术方向。
任职要求
学历和专业要求: 计算机视觉或图形学相关方向的博士/硕士同学 技术技能要求: 1、熟悉常用计算机视觉/图形学算法,对深度学习框架和理论比较熟悉,熟悉DiffusionModel,Transformer等技术,在下列3D数字人相关方向之一有经验者优先:3D动作生成、视频动作捕捉、人体姿态估计、动作重定向、3D人脸动画、3D数字人动画驱动、数字人表情及动作预测、3D相机位姿估计等; 2、熟悉Unity3D/UnrealEngine4等游戏引擎,有使用过三维建模软件Maya/3DsMax/Blender/Motionbuilder等的优先; 3、有计算机视觉或图形学相关的顶级会议如SIGGRAPH、SIGGRAPHAsia、CVPR、ICCV等高水平论文发表者优先。
内推申请说明
本站为独立内推协助平台。申请会交由管理员核实岗位与内推渠道,不等于已在公司官网投递;薪资、岗位状态和实际招聘流程以官方信息为准。