
腾讯|微信助手-支持方言的音频理解模型实习
岗位职责
课题背景:
微信语音消息、语音输入与通话场景覆盖海量用户,但普通话之外还存在大量客家话、邵阳话等小众方言使用需求。现有音频理解模型在方言场景下常出现识别不准、语义理解偏差等问题,影响沟通效率与产品体验,因此需要建设支持多方言的音频理解模型。
课题挑战:
方言种类多、发音差异大,同一句话在不同地区的音系、词汇和语法上差别明显,导致模型泛化困难。另一方面,方言标注数据稀缺且分布不均,部分长尾方言样本极少,训练成本高。真实微信场景中还存在口语化表达、多人混说、噪声干扰、设备差异等问题,需要模型同时具备鲁棒的语音识别、方言适配与语义理解能力。
具体工作:
参与方言语音数据处理与分析,探索多方言音频理解模型训练方案,优化识别与理解效果,并结合真实场景完成评测、迭代和效果验证。
任职要求
学历和专业要求:
来自计算机、人工智能、自动化、电子信息、信号处理、数学等相关专业的博士/硕士同学。
技术技能要求:
掌握深度学习、生成模型、序列建模等算法及应用,熟悉Python,了解PyTorch/TensorFlow等训练框架。
软性素质要求:
具备良好的沟通协作与问题分析能力,对音乐、音频或AIGC方向有兴趣,学习能力和执行力强。
【加分项或注意事项】
此课题同时招聘应届实习生和低年级实习生。
腾讯招聘实习生:微信助手-支持方言的音频理解模型岗位来自腾讯招聘官网,具体内容以腾讯招聘官网为准。
