中国电子信息产业集团有限公司|大模型训练开发工程师

中国电子信息产业集团有限公司 · 中国软件 · 北京 · 更新时间:2026-10-01

岗位职责

1、大模型训练数据治理:参与大模型预训练、微调全流程基础工作,负责各类文本、结构化、业务场景数据集的清洗、去重、脱敏、格式转换、数据抽样与均衡处理,校验数据合规性、完整性与安全性,过滤劣质、违规、噪声数据,搭建标准化基础训练数据集,保障模型训练的数据底座质量; 2、模型训练与微调落地:执行大模型常规训练、SFT微调、增量训练任务,严格遵循研发操作规范,完成训练任务创建、参数配置、任务启动、全程运行监控,精准记录训练Loss、收敛速度、显存占用、训练吞吐量、迭代效率等核心指标,及时排查训练过程中的卡顿、报错等基础问题,保障训练任务稳定推进; 3、模型验证与迭代优化:负责模型训练后的效果验证、性能测试与结果统计,整理、汇总、分析各类验证数据,输出规范完整的模型测试报告与迭代总结报告;持续梳理、优化模型验证流程、测试标准与验收规范,沉淀标准化验证体系,支撑模型持续迭代升级; 4、训练工具与环境运维:维护大模型训练研发环境,负责Conda环境管理、依赖库适配、进程监控、日志采集与排查,优化训练基础脚本与批量处理工具,适配HuggingFace、LlamaFactory等主流生态工具,提升模型训

任职要求

1、环境与运维能力:熟练掌握Linux系统常用操作,可独立完成文件管理、进程监控、日志排查、权限配置、Conda环境搭建与迁移等工作;能够编写简易Shell脚本,实现数据批量处理、任务批量启动、日志批量统计等自动化操作; 2、编程与工具开发能力:具备扎实的Python编程基础,熟练使用主流数据处理库,可独立开发、优化数据集清洗、格式转换、数据抽样、结果统计、指标可视化等自动化工具脚本,提升研发工作效率; 3、大模型生态工具经验:接触并熟练使用至少一种主流大模型训练与推理生态工具,如LlamaFactory、HuggingFace Transformers、Vllm、Swift等,了解工具基础用法、适配场景与常见问题排查; 4、文档与标准化能力:具备良好的技术思维和规范的文档输出习惯,可完整记录模型训练、数据处理、测试验证全流程的问题现象、排查思路、解决方案,持续沉淀标准化操作手册、研发规范和经验库; 5、模型训练基础认知:熟悉大模型训练基础原理与核心指标,深入理解训练Loss、显存占用、训练吞吐量、收敛速度、过拟合/欠拟合等指标的核心含义,具备基础的指标分析、问题研判和训练调优能力;

中国电子信息产业集团有限公司校园招聘:大模型训练开发工程师岗位来自中国电子信息产业集团有限公司招聘官网,具体内容以中国电子信息产业集团有限公司招聘官网为准。