岗位描述(节选)
【岗位职责】
1、探索文本-语音-视觉多模态联合建模技术范式,实现原生多模态表征方法,推动全模态理解与生成能力在机器人场景落地;
2、研发流式全双工实时交互模型,推动端到端语音对话系统的搭建与持续优化,提升交互的自然度与实时性;
3、参与大规模音频/语音数据的建设、清洗、标注、合成与评测体系搭建,构建高质量数据闭环;
4、推进语音前端工程化落地,包括流式识别、上下文增强、热词/专有词优化、ASR纠错等能力建设,提升识别准确率;
5、攻克复杂场景下的识别难题,包括低音质声学环境、远场交互、多语种/方言/中英混场景下的意图识别与语音识别优化;
6、基于语义与声学特征,深度挖掘语音中的意图、情感及环境信息,设计并实现语音对话系统中的意图分类、槽位填充、对话状态追踪等核心模块。
【任职要求】
1、计算机科学、人工智能、语音信号处理、电子信息等相关专业硕士及以上学历;
2、2年以上语音算法研发经验……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 10664 个深圳岗位(全城各职能合计),其中 1773 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 16K,最低 1K、最高 100K。
在招岗位较多的企业:字节跳动 845 个安克创新科技股份有限公司 600 个顺丰 581 个华大智造 498 个华大基因 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。