
卓驭科技|大模型算法实习生(语音/多模态)
岗位职责
1. 参与语音算法研发,包括语音增强、回声消除、语音识别(ASR)等,优化实时语音交互效果;
2. 开发多模态大语言模型(LLM)与视觉语言模型(VLM),探索文本、语音、图像跨模态对齐与交互技术;
3. 构建RAG(检索增强生成)、Agent任务编排等应用框架,推动大模型在业务场景中的落地。
任职要求
1. 计算机科学、人工智能、电子工程等相关专业在读硕士/博士,2026届及以后毕业生优先;
2. 熟悉PyTorch/TensorFlow框架,精通Python/C++,具备扎实的算法与数据结构基础;
3. 掌握语音信号处理技术(ASR/TTS/语音增强)或大模型开发经验(预训练、SFT、RLHF);
4. 了解多模态技术原理,有LangChain、Dify等应用框架使用经验者优先;
5. 较强的英文文献阅读能力,能快速跟进LLM、VLM等领域前沿技术;
6. 良好的沟通能力与团队协作精神,对AI技术商业化落地有热情。
加分项
1. 在语音/多模态领域顶级会议(ICASSP、Interspeech、CVPR等)发表论文或国际比赛获奖;
2. 熟悉Whisper、Qwen-Audio等开源模型,或有流式语音合成/实时对话系统开发经验。
卓驭科技招聘实习生:大模型算法实习生(语音/多模态)岗位来自卓驭科技招聘官网,具体内容以卓驭科技招聘官网为准。
