
理想汽车|【基座模型"理想星"顶尖实习】强化学习算法实习(北京/上海)
岗位职责
加入理想汽车,参与下一代跨本体自动驾驶与具身智能的基座方案从0到1的研发。我们的目标是:用一套统一的大脑架构,同时驱动汽车、人形机器人、仿生平台——让感知、语言、行动真正形成闭环,最终上真车、上实机。
工作职责:
这是"肌肉记忆"。有了世界模型,RL 才能真正 scale。我们在做的事情是:
面向自动驾驶与具身智能的 RL 算法研究(Model-based/Free、Online/Offline RL)
构建大规模分布式 RL 训练系统
探索模仿学习、逆强化学习、Scalable Oversight 等提升策略泛化的方法
与世界模型团队深度协作,完成 sim2real 迁移
任职要求
任职资格:
1、本科及以上在读,不限年级,计算机、人工智能、自动化、机器人等相关专业优先;
2、扎实的编程能力,熟练掌握 Python,熟悉 C/C++ 者优先;善于使用 AI Coding 工具(Cursor、Claude Code 等)提升开发效率;
3、良好的深度学习基础,熟悉主流视觉/语言模型架构(ViT、LLM、Diffusion 等),有实际模型训练经验者优先;
4、有以下一项或多项经验者优先:
多模态大模型(VLM/MLLM)的训练或应用
具身智能(Embodied AI)、机器人学习
3D 视觉、视频理解/生成、世界模型
大规模分布式训练(DeepSpeed、FSDP 等)
5、在顶级学术会议或期刊发表论文、有高质量开源项目、或 ACM/Kaggle 等编程与机器学习竞赛获奖者优先;
6、思维敏锐,学习能力强,能快速理解新领域并找到关键问题;自驱力强,善于在开放性问题中独立探索和推进;
7、实习时间 6 个月及以上,每周至少投入 4 天。
理想汽车招聘实习生:【基座模型"理想星"顶尖实习】强化学习算法实习(北京/上海)岗位来自理想汽车招聘官网,具体内容以理想汽车招聘官网为准。
