岗位描述(节选)
1、负责/主导双足机器人强化学习(RL)运控算法研发,覆盖行走/转向/起步停止/跑步、上下坡与台阶、抗外力扰动等核心能力,并实现真机稳定闭环。
2、搭建并维护训练Pipeline:仿真环境构建(动力学、接触、执行器与传感器模型)、奖励函数与课程学习、并行采样与训练监控、实验可复现与版本管理。
3、负责Sim2Real落地与鲁棒性提升:域随机化(质量/惯量/摩擦/延迟/噪声)、系统辨识、策略泛化与真机调参闭环。
4、设计并实现策略与底层控制栈对接(PD/阻抗/WBC/状态机),处理控制频率、延迟、力矩/速度饱和、关节限位与安全保护等工程约束。
5、构建并优化步态与接触切换稳定性(单/双支撑过渡、落脚冲击、滑移抑制),降低抖动与能耗,提升步态自然性与可控性。
6、建立异常工况处理机制:跌倒检测、失稳恢复(fall recovery)、安全降级、故障注入测试与保护策略。
7、制定并维护双足运控评……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。