岗位描述(节选)
作为先进大模型安全体系的核心驱动力,负责构建覆盖“数据-训练-推理-应用”全生命周期的大模型安全防御体系。重点结合评测优先和内生安全等理念,从根本上设计并落地具备安全基因的大模型架构,对抗提示注入、越狱攻击、数据泄露及滥用等新型AI安全威胁,确保大模型在高风险业务场景下的可信、可控与合规。
【核心职责】
1. 安全评测体系建设
● 主导构建面向大模型和智能体(LLM/VLM/Agent)的多维度、自动化安全评测平台,覆盖鲁棒性、合规性、偏见歧视、隐私保护、有害内容生成等关键维度
● 设计并维护动态更新的对抗性测试集与红队(Red Teaming)攻击库,包括但不限于提示注入、越狱攻击、多轮对话诱导等高级攻击手法
● 研究前沿性AI的风险滥用和失控问题,例如CBRN、伦理、多智能体失控、AI发展提升网络攻击威胁等问题并进行科学和有效的检测度量
● 建立客观、可量化的安全评分体系及安全等级认证……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。