进入工作台 →

Token Foundry-语音识别/语音大模型算法专家-Qwen Audio

🏢 阿里巴巴集团(含高德/阿里云)📍 北京/杭州
🎓 硕士 🧭 3年以上 🎯 社招 发布于 2026-09-03 来源:阿里巴巴招聘
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

1. 主导多模态理解/音频大模型的前沿算法研究及产业落地。 2. 音频理解方向: (1)研发语音识别、语音翻译以及音频分析等理解算法。 (2)开发跨模态(语音/文本/视觉)的音频语义理解系统。 (3)探索音频大模型架构设计。 (4)推动算法成果转化:通过ModelScope开源社区创造研究价值,或通过阿里云产品体系创造商业价值。 (5)持续跟踪国际前沿技术动态(ICASSP/Interspeech/NeurIPS/ICLR等),参与国际会议、研讨会,与全球顶级团队进行交流合作。 【任职要求】 1. 计算机科学、信号处理、语音处理、人工智能等相关领域硕士及以上学历。 2. 2年以上音频AI研发经验,包括但不限于 音频识别及理解、音频生成、数字人、多模态交互 等方向。 3. 扎实的深度学习基础,熟练掌握PyTorch/TensorFlow等框架。 4. 优秀的编程能力(Python/C++)…… 完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像