岗位描述(节选)
1.参与智能语音前沿技术研发,重点开展全双工语音交互、端到端语音大模型、语音识别与合成 等关键技术研究。
2.面向智能客服场景,开展方言/口音识别、低时延语音交互、自然打断、语音生成及复杂声学环境下的算法优化。
3.参与语音模型训练、评测、推理优化及工程落地,推动新一代智能语音能力在规模化客服场景应用。
【任职资格】
1.教育背景:硕士研究生及以上学历,计算机,电子信息工程,信号与信息处理等等3T(IT/DT/CT)相关专业。
2.核心能力:
1)具备扎实的深度学习及编程基础,熟悉Python/C++等至少一种编程语言,掌握ASR、TTS及语音大模型基本原理。
2)具备全双工语音交互、端到端语音大模型、ASR/TTS或语音多模态模型相关项目、科研或实习经验者优先。
3)具备良好的算法研究和工程实践能力。在语音、NLP或人工智能相关会议/期刊发表论文者优先。