小米|视觉理解大模型算法工程师

小米 · 北京 · 更新时间:2026-09-11

岗位职责

1. 深入调研多模态大模型、计算机视觉、大模型推理以及强化学习等方向的前沿技术,并结合产品对算法进行优化,使相关产品效果达到业界领先水平; 2. 探索多种模态的融合对齐策略,以及多模态多任务联合训练; 3. 参与多模态大模型落地到小米各个产品,结合产品需求,参与算法的设计、开发、验证、集成、优化和维护,解决算法产品化过程中的各种技术问题,确保达到上线要求。

任职要求

1.硕士及以上学历,计算机、人工智能、机器学习、电子信息、自动化、数学等相关专业,多模态大模型、计算机视觉等相关方向; 2.具备一定的多模态算法或计算机视觉实践经验,对计算机视觉和深度学习算法有深入理解; 3.具备优秀的编程能力,熟练掌握PyTorch等至少一门深度学习框架,熟练掌握Python或C++等至少一门编程语言; 4.对多模态大模型、计算机视觉、深度学习等领域有比较强的兴趣,能每周实习四天以上,实习三个月以上; 5.在多模态大模型、计算机视觉、深度学习等领域发表过高水平论文,或参加过相关领域主流算法竞赛且取得优秀成绩者,优先; 6.在ACM/ICPC、CodeForces、IOI/NOI/NOIP/CSP等编程算法竞赛中获得优秀成绩者,优先。

小米校园招聘:视觉理解大模型算法工程师岗位来自小米招聘官网,具体内容以小米招聘官网为准。