阿里巴巴|AI Infra工程师 - 大模型方向(T-Star Lab日常实习)

阿里巴巴 · 淘天集团 · 北京 · 更新时间:2026-03-26

岗位职责

我们致力于打造面向搜推广场景 & 广告营销场景的业界领先AI Infra平台。团队贴合 阿里电商核心营销业务,承担着超大规模特征工程、深度学习与多模态训练推理、 AIGX & LLM 分布式训练与在离线推理、实时数据回流等关键职责,在高性能服务和优化、分布式计算和存储系统、并行与异构计算加速(CPU/GPU/XPU)和深度学习编译优化等课题上都具有业界最前沿的挑战。希望你能够立足AI Infra方向,保持技术敏感性,推进基座大模型与广告-大模型结合的 AI Training & Inference 的系统级优化。在这里,你将接触到前沿的电商搜推广技术,以及有机会提前获得秋招直通T-Star的正式Offer。岗位课题:大模型 AI Infra 的 Algorithm-Training-Inference-Hardware co-design课题项目背景:面向广告业务的大盘提效(广告-大模型结合)、营销场景的 AIGX & LLM/MLLM,整体的大模型技术体系已经深度渗透到了日常业务迭代中,需要与算法协同解决基座模型(超大规模MoE)的 Training & Inference 系统性能与计算效率问题。成长资源:计算机体系结构/计算机网络领域的博士及大模型技术相关算法工程化领域senior/staff engineer 的贴身指导;业界最前沿问题、世界级业务场景的落地挑战;不光做系统,通过 Algorithm-Training-Inference-Hardware 协同设计,还能深入理解算法与硬件。岗位职责:1. 超大规模Sparse-Dense模型(for 广告)和Dense大模型(for GenAI应用)的训练架构设计优化并推动生产落地。2. 大规模异构硬件Training系统的计算性能与效率优化。3. Algorithm-Training-Inference Co-Design,整体提升模型效率。

任职要求

1. 硕士及以上学历,2026年11月1日以后毕业,计算机科学/人工智能/机器学习/自动化等相关专业,能连续实习3个月及以上;2. 具备扎实的编程基础(C/CUDA/C++/Python),熟悉常用算法与数据结构,掌握机器学习基础理论,了解搜推广系统/自然语言处理/多模态等至少一个领域;3. 有PyTorch/TensorFlow等框架使用经验,参与过算法竞赛(Kaggle/天池等)或开源项目者优先;4. 对AI技术充满好奇心,主动大模型、搜推广系统、NLP、强化学习等领域前沿进展;5. 在顶级会议或高水平期刊发表过论文,或有复现前沿论文的经验者优先;6. 具备较强的问题拆解能力,能通过数据分析定位业务痛点并提出创新思路;7. 良好的沟通能力,能与工程师、产品经理高效协作,将技术方案转化为业务价值;8. 对电商场景有基本认知,愿意深入理解用户需求与商业逻辑。【加分项】1. 有大模型训练(如Megatron、DeepSpeed等)/微调(如Llama、GPT、Qwen、多模态模型)/推理(如vLLM、TRT-LLM等)经验或搜推广算法工程相关项目经历;2. 有海量数据处理经验或者大厂实习经验;3. 在算法竞赛中获得优异成绩(ACM-ICPC/挑战赛TOP10等)或者顶会论文发表。4. 实习要求至少3个月,最好达到半年以上。

阿里巴巴招聘实习生:AI Infra工程师 - 大模型方向(T-Star Lab日常实习)岗位来自阿里巴巴招聘官网,具体内容以阿里巴巴招聘官网为准。