快手|大模型训推优化实习岗

快手 · 北京 · 更新时间:2026-06-09

岗位职责

1、负责文生图、文生视频等自研大模型核心算子的自研开发与性能优化,基于CUDA、OpenAI Triton等工具实现高性能计算加速; 2、针对AI Infra大模型推理与训练场景,优化混合精度量化策略,设计低比特计算、稀疏化压缩等方案,提升模型部署效率; 3、深入GPU/Tensor Core硬件架构,优化显存管理、计算图调度及分布式通信,提升模型训练吞吐与资源利用率; 4、搭建端到端模型推理流水线,探索多模态生成任务下的算子融合、动态编译等创新优化手段; 5、协同算法团队完成模型轻量化落地,提供量化感知训练(QAT)、模型剪枝等技术支持。

任职要求

1、计算机科学、电子工程或相关专业硕士及以上学历,2年以上CUDA/GPU高性能计算开发经验; 2、精通PyTorch/Sglang/vLLM等框架底层实现,熟悉大模型部署与推理优化原理; 3、熟练掌握OpenAI Triton编程,具备算子内核开发经验(如矩阵乘、Attention、Conv等模块优化); 4、熟悉模型量化技术(INT8/FP8/INT4混合精度)优先; 5、对GPU硬件架构(如Hopper/Ada)有深入理解,能结合硬件特性设计高性能算子。 加分项: 1、在CVPR/NeurIPS等顶会发表过模型压缩、加速相关论文或开源项目贡献者; 2、有文生视频、3D生成等长序列生成模型的并行化优化经验; 3、熟悉分布式训练框架(DeepSpeed/Megatron)或AI芯片(如NPU)开发经验; 4、具备多模态大模型(如Diffusion Model)端到端部署落地经验。

快手招聘实习生:大模型训推优化实习岗岗位来自快手招聘官网,具体内容以快手招聘官网为准。