岗位描述(节选)
1. 负责面向AI手机等ToB场景的多模态交互模型研发,包括语音基础模型、视觉-语言模型(VLM)、全模态大模型的后训练(CPT/SFT/RL)与推理优化。
2. 研发基于神经网络、扩散模型或大模型的端侧音频信号处理算法(如语音增强、降噪、去混响),提升复杂声学环境下的语音交互质量。
3. 构建支持自然打断、精准判停、上下文感知的实时双工交互模型,实现低延迟、高鲁棒性的流式对话体验。
4. 针对端侧资源约束,开展模型压缩、量化、蒸馏及高效部署,确保算法在DSP/NPU等嵌入式平台稳定运行。
5. 与系统、产品团队紧密协作,推动算法从原型验证到大规模商用落地。
【任职要求】
1. 计算机、人工智能、电子工程等相关专业硕士及以上学历,3年以上AI模型或音频算法研发经验。
2. 在以下至少两个方向有扎实实践:
①基于神经网络/Diffusion/LLM的语音信号处理(增强、降……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。