
腾讯|大语言模型推理能力研究实习
岗位职责
课题背景:
随着大语言模型的发展,单纯依靠扩大预训练规模带来的收益正在边际递减,研究前沿已全面转向 “慢思考”与测试时计算的扩展。尽管模型在通用自然语言任务上表现优异,但在复杂数学推导、长周期代码生成及多步逻辑规划等深层符号推理任务中,仍面临幻觉频发、自我纠错能力弱及推理链条易断裂等瓶颈。本课题聚焦于提升 LLM 的系统性与原生推理能力,探索以强化学习、自我博弈及动态测试时计算为核心的全链路推理能力增强机制与前沿评测体系。
课题挑战:
1、长链推理的鲁棒性与内生自我纠错:在多步复杂推理中如何避免错误级联,赋予模型在推理过程中的反思验证能力;
2、推理能力的跨领域泛化:如何将基于数理逻辑训练出的强推理能力,有效泛化至缺乏明确对错边界的开放域指令遵循、通用自然语言处理甚至多模态智能体任务中。
具体工作:
参与新一代 LLM 推理能力评测体系建设;主导或参与推理导向的强化学习算法的实验与策略调优;推动相关前沿推理模型及 Agent 系统的工程落地与泛化应用。
任职要求
1、包含但不限于计算机、信息工程、人工智能、自然语言处理、应用数学、统计学、物理学等专业的博士和优秀硕士;
2、熟练掌握大语言模型基本原理(Transformer架构、预训练、RLHF等),熟悉主流推理增强方法(MCTS、过程奖励模型、RLVR 等);
3、熟悉PyTorch、Hugging Face Transformers等深度学习框架,具备大模型训练/微调的实践经验,掌握Python编程语言,具备较强的工程实现能力;
4、加分项:在NLP/推理/LLM相关领域发表过顶会论文(如NeurIPS、ICML、ICLR、ACL等);有开源大模型或推理相关项目维护经验。
【加分项或注意事项】
此课题同时招聘应届实习生和低年级实习生。
腾讯招聘实习生:大语言模型推理能力研究岗位来自腾讯招聘官网,具体内容以腾讯招聘官网为准。
