岗位描述(节选)
1.负责AI Agent评测体系的产品化建设,面向Agent设计科学、可扩展的评测方法与产品流程;
2.数据闭环与模型策略驱动:将评测数据转化为模型迭代的策略输入,建立"评测→归因→策略建议→效果验证"的数据驱动闭环,推动 Agent 能力持续提升形成飞轮。
3.平台型评测产品建设:面向不同业务方的 Agent 评测诉求,设计可配置、可复用、可运营的平台功能,包括评测任务管理、Case/数据集管理、Rubric/标签体系、Evaluator 配置、人评/机评协同、结果分析、回归对比,推动评测方法沉淀为标准化产品能力。
4.持续跟进并解决业务接入过程中的问题,以客户为中心,结合平台视角,从用户痛点和需求中识别出有价值的功能点沉淀在平台,持续提升用户使用体验。
【任职要求】
1.本科及以上学历,3年以上大模型评测 或 Agent 产品 或 B 端平台产品相关经验。
2. AI实战经验……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。