岗位描述(节选)
1、负责多媒体各场景音频算法处理和策略的研发,保障高质量的音频发布和消费体验;
2、负责音频生成算法的研发与业务落地:语音美化与人声增强、变声与音色转换、多模态音频生成等方向;
3、负责音频理解模型的构建与应用:音频理解基座、音频美学评价等;
4、负责基于 AI 的音频前处理算法的研究,包括但不限于 NN 语音增强、PVAD 等音频前处理算法;
5、跟踪业界前沿音频技术,包括但不限于前沿多模态模型和空间音频等方向的调研与业务落地。
【任职要求】
1、硕士及以上学历,计算机、信号与信息处理或声学等相关专业,3 年及以上音频算法或深度学习相关经验;
2、精通 Python 编程,熟悉 PyTorch 等深度学习框架,具备良好的代码规范和系统设计能力;有 C/C++ 工程能力者优先;
3、熟悉以下至少一个音频相关领域:
① 扩散模型(Diffusion)、Flow Matching、Neura……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。