快手|多模态视频生成算法实习生-【可灵团队】

快手 · 深圳 · 更新时间:2026-06-09

岗位职责

1、参与快手kling多模态视频生成的研发和落地工作(实习生以发论文为主),包括但不限于: t2v,i2v等基础模型研发、多模态可控视频生成编辑、世界模型等; 2、探索将多模态大语言模型mllm如deepseek/qwen相关技术与视频生成相结合,包括但不限于:提升kling视频生成的多模态理解、推理、多轮交互能力等; 3、探索将语音和视频生成相结合,包括但不限于:语音驱动的视频生成,有声视频等; 4、探索实时可拓展的多模态视频生成技术,提升多模态视频生成的质量和效率等; 5、在顶会顶刊上发表研究成果和开源代码,提升团队在多模态视频生成等领域的学术声望。

任职要求

1、熟悉视频生成基础模型如SVD、Sora、meta moviegen、hunyun video等; 2、熟悉多模态大语言模型(deepseek/qwen等)、多模态理解生成、世界模型优先; 3、熟悉语音驱动视频生成、语音生成优先; 4、有多模态大语言模型、图像/视频生成、3D生成大规模训练和数据清洗经验者优先; 5、学习能力强、自驱、代码能力强、善于解决问题者优先; 6、有一作顶会或顶刊论文发表经历或相关知名大模型开源项目者优先。 可灵欢迎优秀同学加入: 团队大部分实习生是cuhk/hku/hkust,清北浙等高校的优秀博士生,大家合作交流密切。欢迎优秀同学加入!

快手招聘实习生:多模态视频生成算法实习生-【可灵团队】岗位来自快手招聘官网,具体内容以快手招聘官网为准。