岗位描述(节选)
1. 多模态模型开发:设计并优化视觉-语言等多模态输入的导航模型,使智能体能准确解析自然语言指令及其对应的环境多传感器输入特征,构建智能体对物理空间的感知与记忆能力,解决跨场景泛化与长程规划难题;
2. 导航策略优化:研发基于强化学习(RL)或模仿学习(IL)的导航决策算法,解决寻物/指令跟随等导航及动态避障等问题,利用相关仿真环境(如 Habitat, Isaac Sim)进行模型训练与性能评测;
3. 数据工程:构建和维护大规模 VLN 数据集,3D几何重建/生成式重建等方法构造具身导航数据,或从非结构化数据(如 YouTube 视频、人类演示数据)中提取导航数据,设计高效自动标注系统;
4. 前沿技术转化:跟踪 VLN,NWM等学术界最新进展,并将其应用于实际的具身智能产品中;
5. 算法部署与优化:将复杂的导航算法在边缘侧硬件上实现低延迟推理,处理 Sim-to-Real 的迁移挑……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。