进入工作台 →

Token Foundry-基础大模型预训练数据算法-Qwen

🏢 阿里巴巴集团(含高德/阿里云)📍 北京/杭州
🎓 硕士 🧭 1年以上 🎯 社招 发布于 2026-09-16 来源:阿里巴巴招聘
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

1. 负责Qwen大模型预训练数据的算法设计与体系建设,面向海量文本、代码、多模态等数据,开展数据采集扩充、质量评估、筛选配比和合成优化,建设高质量、可持续迭代的预训练数据管线; 2. 持续建设面向mid-train阶段的模型驱动的合成与质检链路,围绕知识、推理、代码、长文、Agent、多模态等核心能力方向,形成数据生产、质量控制与训练反馈的闭环优化机制,不断提升数据密度、能力针对性与最终训练收益; 3. 持续完善数据实验与验证链路,构建覆盖不同模型参数规模的数据scaling研究策略,系统分析数据策略在不同参数规模下的收益迁移与效果一致性,同时丰富预训练评测体系,跟进大模型前沿技术研究,推动预训练数据闭环迭代,打造业内领先的数据算法能力。 【任职要求】 1. 毕业于全球Top高校计算机科学、人工智能、机器学习、软件工程或相关专业,具备扎实的学术基础与技术能力,博士优先; 2. 在大语言…… 完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像