岗位描述(节选)
工作职责:
1. 负责LLM/Agents的训练与对齐体系搭建,制定面向长思维链推理、任务分解、目标寻优、工具使用的行为学习与对齐策略,包括SFT、偏好学习、RL、离线数据驱动等相关技术落地。
2. 负责训练数据与评测体系的设计与实施,包括轨迹数据的采集、标注、合成与优化,搭建科学合理的评测指标与流程,保障模型训练效果。
3. 负责利用非结构化文档构建LLM微调数据库,优化数据质量与多样性,支撑大模型领域适配与性能提升。
4. 将LLM/大模型mid-training与post-training技术引入科学模型领域,开展领域适配继续训练、指令微调、偏好优化/对齐、工具使用与评测流程优化,使模型满足科学任务需求(如结构化输出、引用可追溯、约束一致性等)。
5. 负责智能体系统后端服务的设计、开发、部署与维护,保障系统的稳定性、高效性与可扩展性,支撑智能体在科学场景的落地应用。
任职资格:
1……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。