岗位描述(节选)
1、负责内容安全防控体系搭建,负责语言大模型防控能力及链路建设,包括风险内容识别能力、越狱识别能力、意图识别能力、安全代答能力等,保证业务安全及大模型应用安全;探索前沿LLM应用方案,落地千问等全业务审核场景;
2、参与语言大模型风控的数据、算法、决策完整体系建设,端到端拦截业务生成风险的同时,通过安全干预方式提升用户使用体验;负责审核模型的post-training,通过SFT/DPO/GRPO等方式实现审核规则输入及细粒度单轮/多轮风险内容识别;
3、负责搭建&迭代应急响应机制,实现对突发应急事件的实时拦截、应急处置,搭建自动迭代机制分钟/小时级闭环覆盖新增风险;
4、负责“数据生成/评估(Synthetic data/LLM-as-a-Judge)-审核模型训练-护栏攻击/风险挖掘(Agent)”的自动化迭代流程搭建,在业务场景打造行业一流的语言大模型安全风控体系。
【任职要求】
……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。