岗位描述(节选)
负责围绕AI大模型的模型评测与模型研究工作,具体工作内容包括但不限于:
1. 深入理解大规模语言模型的模型结构、训练过程以及评测方式,根据模型的训练过程以及评测结果,对大语言模型存在的问题进行研究。
2. 深入分析模型效果不符合认知的异常,根据具体的异常制定完善的研究策略,通过对比、归纳等方法,产出研究分析结论,探索突破性的优化方案,带来模型效果的迭代和突破。
3. 构建Data-Centric的数据-训练-评测闭环,探索研究包括但不限于下列方向:大模型数据、模型的Scaling Law,研究数据配比、加入方式与时机等对模型效果的影响。
4. 追踪大模型方向的前沿进展,积极主动地学习和探索新数据分析、模型训练以及模型评测方法。
5. 与各相关部门保持良好沟通,深度参与大模型预训练、SFT、RLHF和评测等阶段,共同推动大模型持续优化。
【任职要求】
1. 硕士及以上学历,计算机、数学、……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。