岗位描述(节选)
【岗位职责】
1、负责具身智能场景下多模态(语音、视觉、文本、触觉等)交互算法的设计、开发与优化,重点解决多模态数据融合、语义理解、意图识别等核心问题;构建具身多模交互领域专用数据集,设计数据增强与清洗策略,支撑模型训练与迭代;
2、深入分析用户需求与使用场景,设计自然流畅的交互逻辑(如多轮对话、情感识别及场景化服务);与上下游团队紧密协作,明确多模态交互的产品需求与技术指标,制定算法迭代交付计划,跟进项目进度,解决开发过程中的技术难题;
3、优化RAG技术体系(包括向量检索、ES检索及图数据库检索方案),提升语义理解与知识融合能力;了解并关注模型在云侧及端侧的工程化部署技术,优化模型结构,确保低延迟与高稳定性;
4、持续跟踪行业动态、技术趋势,提出突破性技术方案并推动POC验证;
5、负责多模态算法相关技术文档的撰写(包括设计文档、开发手册、测试报告等),沉淀技术资产。
【任职要求】
……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 2297 个北京技术研发岗位,其中 174 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 20K,最低 2K、最高 70K。
在招岗位较多的企业:字节跳动 683 个理想汽车 236 个长鑫科技 143 个美团 111 个阿里巴巴集团(含高德/阿里云) 109 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。