岗位描述(节选)
1. 围绕模型自进化方向开展算法研究与系统研发,探索大模型能力自动演进的关键路径。
2. 聚焦Agent任务,为模型注入自动迭代RL/SFT训练数据的能力,包括Agent环境/query/verifier合成、筛选、训练、反馈闭环优化,通过多轮迭代提升训练数据质量。
3. 为模型注入自动挖掘CPT/PT训练数据的能力,提升预训练和持续训练数据的知识覆盖度、有效性与任务适配性。
4. 为模型注入自动化训练与自动化Infra调优能力,包括Verl、Megatron等框架的训练策略优化、RL超参搜索、训练稳定性提升、SGLang、vLLM推理效率优化等,提升模型研发效率和性能上限。
5. 研究基于self-evolving、long-horizon等范式的能力增强方法,提升模型在自迭代任务中的长期规划、任务分解、多步执行与自主反馈优化能力。
6. 跟踪相关领域前沿进展,结合实际问题开展算法创新、……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。