进入工作台 →

千问事业部-音频多模态生成算法专家-杭州/北京/上海

🏢 阿里巴巴集团(含高德/阿里云)📍 北京/杭州/上海
🎓 硕士 🧭 2年以上 🎯 社招 发布于 2026-09-16 来源:阿里巴巴招聘
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

1. 负责音频多模态生成大模型的研发,包含语音合成、音乐生成、音效生成和歌曲生成等任务的基础研究和应用落地; 2. 研发基于扩散模型(Diffusion Models)或自回归模型(AR)的音频生成算法; 3. 研究音频表征、强化学习或语音端到端等技术方向。 【任职要求】 1. 计算机、信号处理、数学等相关专业硕士/博士学位,3 年以上相关工作经验; 2. 在语音合成、音乐生成、音效生成或语音端到端等领域有深入研究,具备大规模数据训练经验; 3. 熟练掌握 PyTorch/DeepSpeed/Megatron等框架,有高性能推理优化经验者优先; 4. 发表过领域顶级会议文章(NeurIPS、ICML、ICLR、ACL、ICASSP、Interspeech等)、相关实习经验或者ACM竞赛获奖者优先。
© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像