
智元|端侧Agent模型算法工程师-灵犀业务部
岗位职责
灵犀是智元半尺寸人形机器人的核心产品线,也是智元最年轻、最具创新活力的团队之一。我们打造了智元首个爆款产品灵犀X2,累计销量超6000台。这里技术大牛汇聚、工程师文化浓厚,你将深度参与从技术创新、产品定义到规模化落地的全过程,与顶尖团队共同定义下一代人形智能交互服务终端。
1. 数据 pipeline 工程:负责端侧 LLM、BERT 等模型的数据采集、清洗、标注、构建,搭建可复用的训练数据流水线(数据 → 训练 → 评估的完整闭环)。
2. 模型训练与优化:训练 / 微调端侧模型,包括 LLM 蒸馏(大模型能力迁移到端侧小模型)、BERT 意图识别 / 槽位填充等 NLU 模型。
3. 模型压缩与量化:通过蒸馏、剪枝、量化(INT8 / INT4 等)压缩模型,在精度与端侧算力 / 内存约束之间做权衡调优。
4. (加分)端侧量化部署:把模型部署到边缘设备(如 Jetson Orin NX 等),打通推理引擎与端侧性能调优,保障实际场景下的延迟与稳定性。
任职要求
1 基本要求:
- 2027 届本科及以上,计算机 / 人工智能 / 电子 / 自动化 / 数学等相关专业。
- 扎实的机器学习 / 深度学习基础,熟悉 Transformer、BERT、LLM 等模型原理。
- 熟练 Python,熟悉 PyTorch(或 TensorFlow)等至少一个主流深度学习框架。
- 有完整跑通模型训练 pipeline 的项目 / 实习 / 竞赛经历(数据处理 → 训练 → 评估 → 调优)。
- 了解模型蒸馏、量化、剪枝等压缩技术的基本原理。
2 加分项:
- 有端侧 / 边缘设备**模型部署经验(TensorRT / ONNX Runtime / llama.cpp / GGUF / TVM / NCNN / MNN 等)。
- 熟悉量化部署工具链与推理引擎,做过端侧推理性能优化(延迟 / 内存 / 功耗)。
- 熟悉意图识别 / NLU / 对话系统相关模型与评测。
- 有 LLM 微调 / 蒸馏 / 量化 / RAG 的实践经历。
- 了解机器人 / 具身智能相关场景,关注模型在真实物理环境的落地。
智元校园招聘:端侧Agent模型算法工程师-灵犀业务部岗位来自智元招聘官网,具体内容以智元招聘官网为准。
