岗位描述(节选)
1. 跟踪具身智能前沿方向,包括但不限于视觉语言模型 (VLM)、视觉语言动作模型 (VLA)、世界动作模型 (WAM) 等方向;
2. 设计面向家用机器人的具身操作模型架构,基于大规模数据进行具身模型预训练和后训练,实现复杂场景下的3D空间理解、动作语义映射、长时序任务规划等能力;
3. 在长程任务理解和操作的成功率和泛化能力提升方面取得突破;
4. 实现基于触觉和灵巧手的精细操作任务。
【任职要求】
1. 计算机、人工智能、机器人学、自动化控制等相关专业;
2. 具备具身操作大模型相关的模型预训练、后训练、推理部署等项目经验,具备大规模多卡并行训练的实践经验,熟悉具身智能场景下的模型开发流程;
3. 熟悉VLA/WAM领域的主要算法工作,熟悉具身开源数据集;
4. 熟练掌握 Python/C++ 等编程语言,熟悉 PyTorch/TensorFlow 等深度学习框架,具备良好的代码工……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。