岗位描述(节选)
1. 参与训练医疗大模型,包括但不限于模型SFT、强化学习系统的算法实验设计、数据收集合成消融、infra 团队协作等;
2. 探索高效的后训练范式,包括高效 SFT、Model Merge、On-policy Distill、 RL等后训练算法以及pipeline,提升发布效果和效率。
3. 提升大模型在Reasoning、Agentic等任务上的能力上限,构建在医疗场景具备深度思考和自主行动能力的基座模型。
【任职要求】
1. 硕士及以上学历,计算机科学或相关专业背景。
2. 具备大模型研发经验,在 Post-Training(如SFT、RL、Model Merge、OPD等)某一方向上有深入积累。
3. 算法与工程兼备,熟悉数据与训练策略,也了解主流训练和推理框架(如 Megatron、SGLang、vLLM等)。
4. 具有良好的学习和沟通能力,有好奇心和责任心,具有钻研精神,能……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。