岗位描述(节选)
【岗位职责】
1、前沿调研与设备控制闭环:深度调研国内外多模态大模型(VLM/VLA)在工业自动化和具身控制领域的最新进展。针对海底捞门店硬件设备,设计“感知-决策-控制”的技术路径,通过改进现有模型提升设备自动化率。
2、多模态状态对齐与动作决策:负责多模态模型的指令微调与空间对齐。将厨房现场的视觉信息与文本指令、设备控制参数进行深度对齐,实现端到端的智能动作规划与设备调控。
3、传统视觉与端侧感知:负责构建高可靠性的传统计算机视觉模块,利用 YOLO 等经典目标检测、语义分割模型,在边缘侧实现对门店物品、设备状态、人员操作的高频、低延迟、高精度感知。
4、混合感知架构设计:将“传统 CV 感知”与“多模态大模型决策(VLM 顶层规划)”进行有机结合,设计务实、高确定性的混合算法架构,解决大模型在物理设备控制中的幻觉与延迟问题。
【任职要求】
1、硬核技术与落地经验(硬性):3-5 年……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 9839 个北京岗位(全城各职能合计),其中 2306 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 5.5K ~ 15K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:美团 1313 个阿里巴巴集团(含高德/阿里云) 797 个理想汽车 498 个京东 336 个小米集团 331 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。