岗位描述(节选)
"岗位职责:
1. 参与具身多模态/VLA/VLM、视觉语言模型、世界模型或策略学习算法的研发与训练;
2. 参与机器人视觉、语言、动作数据处理、训练集构建及模型评测;
3. 参与模仿学习、强化学习、Diffusion Policy等算法在真机上的部署、调试和优化; 4. 跟踪前沿论文并完成算法复现、实验分析和技术沉淀。
岗位要求:
1. 熟悉Python及PyTorch,具备扎实的机器学习、深度学习基础;
2. 了解Transformer、多模态学习、生成模型、模仿学习或强化学习中的至少一个方向;
3. 有机器人操作、VLA/VLM、视觉/视频生成、世界模型相关科研或项目经历优先;
4. 有高水平论文、竞赛成果或开源项目贡献优先;
5. 具备较强的工程实现、实验分析、学习能力和团队协作意识。"