岗位描述(节选)
1. 针对预训练(含mid-training,下同)模型在coding,cowork,长尾知识,长文本能力等方面的弱点,设计并构建具有可扩展性的自动化评测方案及高质量数据集。
2. 整合高质量公开评测集和私有评测集。为不同训练阶段、不同领域、不同优化目标(模型结构/数据配比/主线模型迭代)定制评测方案,挑选质量最高、领域最合适、区分度最好的评测数据与指标。
3. 与工程团队合作提高评测系统的效率与稳定性,完善评测故障分析与检测,并推动文本评测与Agent评测的自动化与可视化。
4. 设计Pretrain + LightSFT的数据配比和训练策略并搭建相关pipeline,实时检测预训练模型的agentic潜力。
5. 设计面向后训练agent能力导向的预训练评测范式,挖掘高预测性的external metrics以及internal indicators,寻找上限更高、潜力更强的预训练基座……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。