岗位描述(节选)
【岗位职责】
1. 负责多模目标语音提取、多模态语音分离、唇动识别等语音前端与多模态感知算法
2. 面向多人重叠、强噪声和弱语音输入等复杂语音交互场景,引入唇动视觉信息作为目标说话人先验,提升目标语音提取与分离的鲁棒性
3. 负责机器人多模态感知融合算法的设计、训练和落地,融合声学、视觉及其他感知算法输出的结构化特征
4. 基于声学DOA、视觉目标位置、目标跟随、用户距离、置信度及历史状态等特征,设计轻量级神经网络,实现帧级或短时序的融合判断
5.负责多源数据的时间同步、特征对齐、标签设计、样本构建、数据清洗和难例挖掘。
6.完成模型训练、调参、评测和误差分析,持续优化模型准确率、召回率、时序稳定性、复杂场景鲁棒性和实时性能。
7.与声学、视觉、机器人系统及交互策略团队协作,定义算法输入输出接口,并将融合结果接入机器人交互链路。
8.负责模型部署和推理性能优化,包括模型导出、推理接口开发、……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 22776 个上海岗位(全城各职能合计),其中 2348 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 8.4K ~ 20K(25~75 分位),中位约 12K,最低 0.8K、最高 120K。
在招岗位较多的企业:字节跳动 2640 个米哈游 644 个智元机器人 542 个蔚来 490 个得物 447 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。