岗位描述(节选)
1. 负责 AIGC 场景下多模态内容安全核心能力的研发与迭代,覆盖图文音视及跨模态组合内容,构建贯穿用户输入、生成过程与输出分发的风险识别、审核、解释和合规控制能力,保障生成内容与业务应用安全。
2. 探索并构建多模态安全大模型,推进其在AIGC内容安全场景的训练与落地。围绕跨模态语义理解、隐式风险识别、风险定位与解释等能力,结合指令微调、偏好优化、知识增强、强化学习及对抗训练等,持续提升模型对新型风险和复杂业务场景的泛化性、鲁棒性与可控性。
3. 探索基于 Agent 的多模态安全审核与治理方案,结合风险知识检索、工具调用、任务规划与多模型协同,构建复杂内容分析、风险证据核验、策略匹配及人机协同处置流程。同时面向 AIGC 与 Agent 应用,建设输入输出防护、上下文与工具调用检查等 Guardrails 能力,防范提示词注入、越狱诱导、敏感信息泄露及不安全工具调用等风险。
4. 负……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。