
蔚来|智能辅助驾驶视觉语言大模型研发实习生
岗位职责
我们正在寻找对大模型与多模态AI研究充满热情的实习生,加入我们的研发团队。该岗位将聚焦多模态大模型在复杂低速场景下的应用,涉及视觉语言模型(VLM)、视觉语言导航(VLN)、大规模语言模型(LLM)等方向,并探索其在实际任务中的优化与落地:
1. 参与多模态大模型在低速复杂场景下的应用研究。
2. 负责数据自动标注、语料生成与处理。
3. 进行模型训练、调优和评估,并优化模型性能。
4. 参与文献调研,跟踪多模态AI领域的最新进展。
任职要求
1. 在读硕士或博士研究生,计算机科学、人工智能、机器学习或相关领域背景优先。
2. 具备扎实的动手实践经验,至少在以下一个方向有实践经历:
3. 视觉语言模型(VLM),如CLIP、BLIP、LLaVA等。
4. 视觉语言行动(VLA),如具身智能、多模态决策等。
5. 纯语言大模型(LLM),如GPT、LLaMA、Mistral等。
6. 熟悉Python编程语言,掌握至少一种深度学习框架(如PyTorch、TensorFlow)。
7. 具备良好的团队协作能力和独立解决问题的能力。
蔚来招聘实习生:智能辅助驾驶视觉语言大模型研发实习生岗位来自蔚来招聘官网,具体内容以蔚来招聘官网为准。
