岗位描述(节选)
职位概述:负责构建小红书AI内容安全和AI应用安全的核心算法体系,覆盖从模型训练、服务上线到内容生成与传播的全链路风险管控,研发先进的生成式内容识别与防护技术,保障平台内容安全与用户体验。
主要职责:
1、构建AI全链路安全防护体系,覆盖训练数据安全、模型安全对齐、服务部署安全、应用场景伦理治理等阶段,识别并应对各环节风险源,落地端到端控制措施;
2、研发全模态AIGC检测算法,覆盖图像静态识别、视频动态内容理解、人物深伪检测、工业创作痕迹检测等方向,实现发布主动校验、存量彻底清扫的完整闭环;
3、构建大模型应用安全防护机制,包括提示词检测、输入输出审核过滤、检索增强安全、滥用行为识别与处置,保障模型在内容生成与用户交互场景下的安全可控;
4、通过数据飞轮与闭环优化机制,持续提升算法性能:关注识别召回准确率、系统资源消耗、高并发承载能力等核心指标,推动架构优化;
5、跟踪生成式AI前沿技术……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。