小红书 社会招聘
生成式大模型安全防护算法专家
北京 ·经验不限·学历不限
北京市·上海市
薪资面议
前往 小红书 官网投递
职位描述
职位概述
负责构建小红书AIGC安全检测与防护的核心算法体系,研发先进的生成式内容识别与风险管控技术,保障平台内容安全与用户体验。
主要职责
1.构建生成式大模型安全防护体系,包括但不限Safety Alignment、恶意提示词检测、输出内容过滤、滥用行为识别等,搭建完整防护链路
2.研发AIGC检测算法,覆盖文本、图像、视频等多模态内容识别,搭建发布主动校验、传播被动检测和处置的完整AIGC识别标识链路
3.通过agentic等技术,设计生成式大模型背靠背攻防演练方案,形成数据飞轮
4.跟踪前沿生成式AI技术演进,预判新型安全风险并研发应对方案,优化检测算法性能和推理成本
5.协同产品、运营、法务、GA团队,保障新产品功能的安全合规与用户体验
【任职要求】
任职要求
1.计算机、人工智能相关专业硕士及以上学历,3年以上AI安全、内容风控或相关算法领域经验
2.具备以下至少一个领域经验:AIGC检测与识别技术、大模型安全与对齐研究、多模态内容理解与风控、对抗样本与攻防技术
3.熟悉大模型后训练 & agentic技术,熟悉生成式模型(扩散模型、LLM等)技术原理,有大规模数据处理经验
4.参与过大型互联网平台内容安全体系建设者优先,有算法落地的工程化经验者优先
5.在顶级会议发表相关论文或专利者优先
官网发布:2026-08-24 · 最后确认在招:2026-09-03 23:16:54 · 来源平台:xiaohongshu