蔚来|智能辅助驾驶视觉语言大模型研发实习生

蔚来 · 数字技术 - 算法 · 北京 · 更新时间:2026-07-06

岗位职责

我们正在寻找对大模型与多模态AI研究充满热情的实习生,加入我们的研发团队。该岗位将聚焦多模态大模型在复杂低速场景下的应用,涉及视觉语言模型(VLM)、视觉语言导航(VLN)、大规模语言模型(LLM)等方向,并探索其在实际任务中的优化与落地: 1. 参与多模态大模型在低速复杂场景下的应用研究。 2. 负责数据自动标注、语料生成与处理。 3. 进行模型训练、调优和评估,并优化模型性能。 4. 参与文献调研,跟踪多模态AI领域的最新进展。

任职要求

1. 在读硕士或博士研究生,计算机科学、人工智能、机器学习或相关领域背景优先。 2. 具备扎实的动手实践经验,至少在以下一个方向有实践经历: 3. 视觉语言模型(VLM),如CLIP、BLIP、LLaVA等。 4. 视觉语言行动(VLA),如具身智能、多模态决策等。 5. 纯语言大模型(LLM),如GPT、LLaMA、Mistral等。 6. 熟悉Python编程语言,掌握至少一种深度学习框架(如PyTorch、TensorFlow)。 7. 具备良好的团队协作能力和独立解决问题的能力。

蔚来招聘实习生:智能辅助驾驶视觉语言大模型研发实习生岗位来自蔚来招聘官网,具体内容以蔚来招聘官网为准。