岗位描述(节选)
岗位职责
1. 负责语音理解相关算法的实现和相关业务落地,包括语音识别,情感识别,语种识别,音频事件检测等;
2. 负责自监督、有监督预训练语音编码器算法研发,语音编码器接入LLM、语音端到端大模型、多模态大模型相关技术的研发和落地;
3. 有机会负责一个方向,参与从零到一的全链路研发工作。
岗位要求
1、音频、机器学习、语音、自然语言处理、机器视觉等相关专业硕士(AI,EE,CS,NLP)及以上学历
2、有情感识别(SER)和情感描述(SECaption)领域经验和车载场景经历者优先。
3、熟悉传统机器学习基础理论,熟练掌握Kaldi, TensorFlow, Pytorch等社区开源工具中的一种及以上,熟练C/C++,Python,Shell编程语言,对数据结构和算法设计有深刻理解,参加过ACM等编程比赛的优先
4、具备语音识别端到端声学建模(LAS,transformer,rnn-t……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 1226 个北京技术研发岗位,其中 138 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 20K,最低 2K、最高 70K。
在招岗位较多的企业:美团 261 个理想汽车 241 个阿里巴巴集团(含高德/阿里云) 109 个神州信息 76 个京东 76 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。