岗位描述(节选)
我们正在寻找对大语言模型基模训练优化有浓厚兴趣和扎实经验的算法工程师,共同推动下一代智能体(Agent)和通用人工智能(AGI)技术的落地。
主要职责:
● 参与蚂蚁自研大语言模型各阶段训练,包括但不限于pretrain、SFT、 PPO、DPO、GRPO等
● 针语DeepResearch类任务的轨迹优化等问题对优化奖励建模、偏好学习及策略微调流程;
● 探索大模型在复杂任务中的自主推理、工具调用与长期规划能力,结合 RL 提升智能体决策水平;
● 与数据、工程、产品团队紧密协作,将算法成果高效集成到线上大模型服务中;
● 跟踪并复现国际顶级会议在 LLM 领域的最新进展。
【任职要求】
1. 计算机、人工智能、自动化、数学或相关专业硕士及以上学历;
2. 扎实的机器学习与深度学习基础,对强化学习算法理论有充分的了解。
3. 具备大模型与 RL 结合的实际项目经验,如preTrain……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。