腾讯|面向角色控制的视频生成大模型实习

腾讯 · IEG · 工作地点:深圳总部 · 更新时间:2026-06-01

岗位职责

课题背景: 随着大语言模型和视频生成技术的快速发展,通过视频引导生成3D游戏动画资产成为可能。本课题旨在探索视频生成模型在游戏角色领域的应用,构建从视频生成到角色动画资产的智能生成管道。通过结合视频生成模型的时序理解能力和游戏引擎的角色控制技术,实现文本驱动的角色动作、表情、交互行为的自动生成。这一方向将为深度学习生成式游戏引擎提供关键的内容生产能力,大幅降低角色动画制作成本,提升创作效率。 课题挑战: 1、视频-3D资产映射:如何从2D视频生成结果中提取可用的3D骨骼动画、蒙皮权重等游戏引擎可直接使用的参数化表示; 2、多模态控制信号融合:探索文本、参考图像、骨骼约束等多种输入如何协同控制视频生成模型,保证角色动作的可控性和一致性; 3、时序连贯性与物理合理性:生成的角色动作需满足运动学约束和物理规律,避免穿模、抖动等游戏中不可接受的瑕疵; 4、角色交互场景生成:研究如何生成角色-角色、角色-场景的交互视频,并转化为游戏引擎中的动态事件序列。

任职要求

1、计算机、人工智能等相关专业硕士或博士学位,在深度学习领域有扎实的理论功底; 2、具有扎实的深度学习算法基础,具备扎实的大模型研发经验,有Diffusion Models和 Autoregressive Models相关经验优先,有相关方向顶级论文者优先,有文生图文生视频实践经验者优先; 3、熟悉各类深度学习网络和算子底层实现细节,训练和推理模型调优,CPU/GPU加速,分布式训练推理加速,有实操经验优先; 4、熟悉端到端预训练,熟悉SFT、RL 微调等后续连流程;熟练使用Python,精通PyTorch框架; 5、具备较强的学习能力、沟通能力、团队合作能力,有强烈的好奇心; 6、在CVPR、ICCV、ECCV、SIGGRAPH 等顶会发表过高质量论文,或在相关开源项目、算法竞赛中获得优异成绩者优先。

腾讯招聘实习生:面向角色控制的视频生成大模型岗位来自腾讯招聘官网,具体内容以腾讯招聘官网为准。