岗位描述(节选)
1. 负责大模型训练、推理、评测、部署等核心链路的质量保障体系建设。
2. 设计并实现自动化评测框架,支持多维度(如准确性、一致性、安全性、推理速度等)的模型能力评估。
3. 构建高质量、可扩展的评测数据集,制定科学、可量化的评测标准与指标体系。
4. 推动CI/CD流程在大模型工程中的落地,保障模型迭代的稳定性与可回溯性。
5. 主导Bad Case分析闭环机制,联动算法、工程与业务团队优化模型表现。
【任职要求】
1. 计算机或相关专业硕士及以上学历,3年以上测试开发或质量保障经验,有大模型/AIGC项目经验者优先。
2. 精通Python/Java至少一种语言,熟悉主流测试框架(如PyTest、JUnit)及自动化工具链。
3. 熟悉大模型基本原理(如Transformer、Prompt Engineering、RLHF等),了解训练/推理/部署流程。
4. 具备数据驱动思维,能设……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。