进入工作台 →

音频生成式AI算法工程师-多媒体技术

🏢 小红书📍 北京市,上海市
🎯 社招 发布于 2026-09-15 来源:小红书招聘
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

1、负责多媒体各场景音频算法处理和策略的研发,保障高质量的音频发布和消费体验; 2、负责音频生成算法的研发与业务落地:语音美化与人声增强、变声与音色转换、多模态音频生成等方向; 3、负责音频理解模型的构建与应用:音频理解基座、音频美学评价等; 4、负责基于 AI 的音频前处理算法的研究,包括但不限于 NN 语音增强、PVAD 等音频前处理算法; 5、跟踪业界前沿音频技术,包括但不限于前沿多模态模型和空间音频等方向的调研与业务落地。 【任职要求】 1、硕士及以上学历,计算机、信号与信息处理或声学等相关专业,3 年及以上音频算法或深度学习相关经验; 2、精通 Python 编程,熟悉 PyTorch 等深度学习框架,具备良好的代码规范和系统设计能力;有 C/C++ 工程能力者优先; 3、熟悉以下至少一个音频相关领域: ① 扩散模型(Diffusion)、Flow Matching、Neura…… 完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像