卓驭科技|大模型算法实习生(语音/多模态)

卓驭科技 · 深圳 · 更新时间:2025-04-03

岗位职责

1. 参与语音算法研发,包括语音增强、回声消除、语音识别(ASR)等,优化实时语音交互效果; 2. 开发多模态大语言模型(LLM)与视觉语言模型(VLM),探索文本、语音、图像跨模态对齐与交互技术; 3. 构建RAG(检索增强生成)、Agent任务编排等应用框架,推动大模型在业务场景中的落地。

任职要求

1. 计算机科学、人工智能、电子工程等相关专业在读硕士/博士,2026届及以后毕业生优先; 2. 熟悉PyTorch/TensorFlow框架,精通Python/C++,具备扎实的算法与数据结构基础; 3. 掌握语音信号处理技术(ASR/TTS/语音增强)或大模型开发经验(预训练、SFT、RLHF); 4. 了解多模态技术原理,有LangChain、Dify等应用框架使用经验者优先; 5. 较强的英文文献阅读能力,能快速跟进LLM、VLM等领域前沿技术; 6. 良好的沟通能力与团队协作精神,对AI技术商业化落地有热情。 加分项 1. 在语音/多模态领域顶级会议(ICASSP、Interspeech、CVPR等)发表论文或国际比赛获奖; 2. 熟悉Whisper、Qwen-Audio等开源模型,或有流式语音合成/实时对话系统开发经验。

卓驭科技招聘实习生:大模型算法实习生(语音/多模态)岗位来自卓驭科技招聘官网,具体内容以卓驭科技招聘官网为准。