岗位描述(节选)
1. 主导多模态理解/音频大模型的前沿算法研究及产业落地。
2. 音频理解方向:
(1)研发语音识别、语音翻译以及音频分析等理解算法。
(2)开发跨模态(语音/文本/视觉)的音频语义理解系统。
(3)探索音频大模型架构设计。
(4)推动算法成果转化:通过ModelScope开源社区创造研究价值,或通过阿里云产品体系创造商业价值。
(5)持续跟踪国际前沿技术动态(ICASSP/Interspeech/NeurIPS/ICLR等),参与国际会议、研讨会,与全球顶级团队进行交流合作。
【任职要求】
1. 计算机科学、信号处理、语音处理、人工智能等相关领域硕士及以上学历。
2. 2年以上音频AI研发经验,包括但不限于 音频识别及理解、音频生成、数字人、多模态交互 等方向。
3. 扎实的深度学习基础,熟练掌握PyTorch/TensorFlow等框架。
4. 优秀的编程能力(Python/C++)……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。