腾讯|多模态动作生成大模型实习

腾讯 · IEG · 工作地点:深圳总部 · 更新时间:2026-06-01

岗位职责

课题背景: 高质量的动画内容创作在当今影视、游戏、等行业中愈发重要, 其中基于3D资产的底层动画内容在质量、灵活性、交互体验等多方面尤为重要, 也是游戏制作中的重要一环. 工业界现有的3D动画制作管线存在高人力场地成本、时间周期长、资产复用率低等问题, 而学术届已有的3D动作生成方案在生成的内容质量、多样性、可控性方面还远达不到工业可用水平。 基于以上现状, 本项目旨在开发一种先进的多模态3D动作生成系统,通过结合人工智能技术与海量3D资产数据,利用视觉、文本等多模态信息,自动可控地生成高质量的3D动画。该系统能够理解复杂的模态输入,结合数字资产制作(DCC)软件(maya、3dsmax, blender等), 可控、交互式地转化为精确的3D动作,极大地提升动画的制作效率和灵活性, 节省人力。此技术不仅可以广泛应用于游戏开发,还能服务于媒体宣发和影视制作行业,帮助从业者快速高效地创作出符合高标准的可用视觉资产。

任职要求

1、计算机、人工智能等相关专业硕士或博士学位,在深度学习领域有扎实的理论功底; 2、深入理解主流多模态融合架构(例如 Single-stream、Double-stream 等),能够针对不同模态特征进行灵活的 Transformer 模块设计; 3、熟悉端到端预训练、SFT、RL 微调等流程; 4、熟练使用 Python,熟练使用 PyTorch 框架; 5、具备 3D 骨骼动画或人体运动学(IK/FK、SMPL 等人体参数化模型)相关经验者优先; 6、具备人体物理仿真(如 PhysX,Isaac Gym,MuJoCo)或基于强化学习的动作控制经验者优先; 7、在 CVPR、ICCV、ECCV、SIGGRAPH 等顶会发表过高质量论文,或在相关开源项目、算法竞赛中获得优异成绩者优先; 8、具备极强的论文复现与改进能力,能够敏锐捕捉大语言模型、视频生成领域的最新技术并将其迁移至动作生成领域。

腾讯招聘实习生:多模态动作生成大模型岗位来自腾讯招聘官网,具体内容以腾讯招聘官网为准。