小米|音视频生成与编辑算法研究实习生

小米 · 武汉 · 更新时间:2026-09-18

岗位职责

1. 参与通用音频生成与编辑、音视频联合编辑相关算法研究与落地。 2. 围绕音视频生成与编辑问题,开展模型调研、方案设计、实验复现与效果优化。 3. 参与高质量音视频数据集构建与清洗,包括质量筛选、音视频相关性检测、音频/视频 caption、标签体系建设和训练数据 pipeline 优化。 4. 建立并完善模型评测体系,围绕音视频质量、语义一致性、编辑可用率等指标进行实验评估和结果分析。 5. 输出阶段性研究成果,包括算法代码、模型权重、实验报告、技术方案以及论文/专利等相关材料。

任职要求

1. 计算机、人工智能、电子信息、自动化等相关专业硕士研究生,具备较好的深度学习基础。 2. 熟悉 PyTorch 等深度学习框架,具备较强的工程实现能力,能够独立完成模型训练、实验调参、结果分析和代码整理。 3. 了解音视频生成、音视频编辑、多模态学习、扩散模型等相关方向之一;有相关论文复现或项目经验者优先。 4. 熟悉音频信号处理基础知识。有音频/语音算法经验者优先。 5. 对视频理解、视觉表征、多模态大模型有了解者优先。 6. 有生成式模型、音视频生成、空间音频等研究经历者优先。 7. 具备较好的英文论文阅读能力、实验分析能力和问题拆解能力,能够持续跟踪前沿论文并转化为可验证的实验方案。 8. 有钻研精神,责任心强,沟通协作良好。

小米招聘实习生:音视频生成与编辑算法研究实习生岗位来自小米招聘官网,具体内容以小米招聘官网为准。