
腾讯|多模态动作生成大模型实习
岗位职责
课题背景:
高质量的动画内容创作在当今影视、游戏、等行业中愈发重要, 其中基于3D资产的底层动画内容在质量、灵活性、交互体验等多方面尤为重要, 也是游戏制作中的重要一环. 工业界现有的3D动画制作管线存在高人力场地成本、时间周期长、资产复用率低等问题, 而学术届已有的3D动作生成方案在生成的内容质量、多样性、可控性方面还远达不到工业可用水平。
基于以上现状, 本项目旨在开发一种先进的多模态3D动作生成系统,通过结合人工智能技术与海量3D资产数据,利用视觉、文本等多模态信息,自动可控地生成高质量的3D动画。该系统能够理解复杂的模态输入,结合数字资产制作(DCC)软件(maya、3dsmax, blender等), 可控、交互式地转化为精确的3D动作,极大地提升动画的制作效率和灵活性, 节省人力。此技术不仅可以广泛应用于游戏开发,还能服务于媒体宣发和影视制作行业,帮助从业者快速高效地创作出符合高标准的可用视觉资产。
任职要求
1、计算机、人工智能等相关专业硕士或博士学位,在深度学习领域有扎实的理论功底;
2、深入理解主流多模态融合架构(例如 Single-stream、Double-stream 等),能够针对不同模态特征进行灵活的 Transformer 模块设计;
3、熟悉端到端预训练、SFT、RL 微调等流程;
4、熟练使用 Python,熟练使用 PyTorch 框架;
5、具备 3D 骨骼动画或人体运动学(IK/FK、SMPL 等人体参数化模型)相关经验者优先;
6、具备人体物理仿真(如 PhysX,Isaac Gym,MuJoCo)或基于强化学习的动作控制经验者优先;
7、在 CVPR、ICCV、ECCV、SIGGRAPH 等顶会发表过高质量论文,或在相关开源项目、算法竞赛中获得优异成绩者优先;
8、具备极强的论文复现与改进能力,能够敏锐捕捉大语言模型、视频生成领域的最新技术并将其迁移至动作生成领域。
腾讯招聘实习生:多模态动作生成大模型岗位来自腾讯招聘官网,具体内容以腾讯招聘官网为准。
