商汤|大模型训练推理实习生

商汤 · 北京/上海/成都 · 更新时间:2026-09-03

岗位职责

工作职责 1. 探索压榨gpu的极致性能,探索推理和模型架构的协同设计等前沿方向。 2. 参与 大模型强化学习(RL)训练系统 的设计与优化,覆盖训练、推理、环境交互与调度等关键环节 3. 跟进并复现业界前沿的 RL 与 MLSys 研究工作,推动新方法在实际系统中的落地

任职要求

任职要求 1. 计算机科学、人工智能、机器学习等相关专业在读硕士或博士(优秀本科生可考虑) 2. 具备扎实的深度学习基础,了解 LLM / VLM 等模型结构 3. 对分布式训练 / 推理 / 系统优化 有强烈兴趣,具备一定实践经验 4. 熟悉 PyTorch,了解或使用过 Ray / FSDP / Megatron / vLLM / RL (VERL, Slime, Areal 等等) 框架 中的一种或多种 5. 具备良好的研究能力与工程习惯,能独立分析问题并推进实验 6.熟悉常见 AI 编程工具(如 Claude Code、Cursor、GitHub Copilot等),能将其有效融入日常开发工作流,具备借助 AI 工具进行代码编写、调试及提效的主动意识。 加分项:cuda并行计算经验/编程竞赛/AI论文经验

商汤招聘实习生:大模型训练推理实习生岗位来自商汤招聘官网,具体内容以商汤招聘官网为准。