岗位描述(节选)
1. 负责语音识别(ASR)核心算法研究与推理引擎开发,对 Conformer、RNN-T、Whisper 等主流架构进行性能优化,覆盖实时转写、离线识别、多语种、强噪声等复杂场景;
2. 负责语音合成(TTS)声学模型与声码器算法研究,对 VITS、NaturalSpeech、CosyVoice 等架构进行优化,提升合成语音的自然度、表现力与推理速度,支撑多发音人、多语种、情感风格可控合成等场景落地;
3. 负责机器翻译算法研究与产品化落地,基于 Transformer 等主流架构进行优化,设计支持云端与离线端的翻译推理框架,覆盖多语种互译、低资源语言对及垂直领域翻译场景;
4. 负责 ASR / TTS / 翻译全链路推理框架设计,推动模型流式改造、INT8/INT4 量化、知识蒸馏、结构剪枝等轻量化技术落地,支撑移动端、嵌入式设备的大并发低延迟部署;
5. 跟进 ASR、TTS、机器……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。