【工作职责】
负责构建小红书AIGC安全检测与防护的核心算法体系,研发先进的生成式内容识别与风险管控技术,保障平台内容安全与用户体验。
主要职责
1.构建生成式大模型安全防护体系,包括但不限Safety Alignment、恶意提示词检测、输出内容过滤、滥用行为识别等,搭建完整防护链路;
2.研发AIGC检测算法,覆盖文本、图像、视频等多模态内容识别,搭建发布主动校验、传播被动检测和处置的完整AIGC识别标识链路;
3.通过agentic等技术,设计生成式大模型背靠背攻防演练方案,形成数据飞轮;
4.跟踪前沿生成式AI技术演进,预判新型安全风险并研发应对方案,优化检测算法性能和推理成本;
5.协同产品、运营、法务、GA团队,保障新产品功能的安全合规与用户体验;
【任职要求】
1.计算机、人工智能相关专业硕士及以上学历,3年以上AI安全、内容风控或相关算法领域经验;
2.具备以下至少一个领域经验:AIGC检测与识别技术、大模型安全与对齐研究、多模态内容理解与风控、对抗样本与攻防技术;
3.熟悉大模型后训练 & agentic技术,熟悉生成式模型(扩散模型、LLM等)技术原理,有大规模数据处理经验;
4.参与过大型互联网平台内容安全体系建设者优先,有算法落地的工程化经验者优先;
5.在顶级会议发表相关论文或专利者优先。