岗位描述(节选)
1、负责设计并持续迭代大模型的安全评测框架体系,定义评测维度、指标与分级标准;
2、通过PE/Agent搭建,实现安全评测样本的自动化生成、自动化判定;设计并落地端到端的自动化评测 Pipeline,持续迭代评测平台能力;
3、输出高质量的安全评测报告,对评测结果进行归因分析,推动模型训练、安全策略等相关方闭环优化,持续提升业务和模型的安全水位;
4、设计并执行针对大模型的对抗性红队测试,探索和落地自动化红队方法,持续发现模型安全弱点与防护漏洞;
5、基于线上海量用户数据,设计数据挖掘策略,识别真实场景中的安全风险模式,沉淀高价值 badcase 并反哺评测集和安全策略优化;
6、追踪大模型安全评测领域前沿论文与业界实践,持续引入新方法、新工具优化评测框架、自动化链路、红队测试。
【任职要求】
1、本科及以上学历,计算机科学/人工智能/软件工程/大数据技术/统计学或相关专业优先考虑;
2……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。