直招.cv

← 返回职位列表

小红书 社会招聘

生成式大模型安全防护算法专家

北京 ·经验不限·学历不限

北京市·上海市

职位描述

职位概述 负责构建小红书AIGC安全检测与防护的核心算法体系,研发先进的生成式内容识别与风险管控技术,保障平台内容安全与用户体验。 主要职责 1.构建生成式大模型安全防护体系,包括但不限Safety Alignment、恶意提示词检测、输出内容过滤、滥用行为识别等,搭建完整防护链路 2.研发AIGC检测算法,覆盖文本、图像、视频等多模态内容识别,搭建发布主动校验、传播被动检测和处置的完整AIGC识别标识链路 3.通过agentic等技术,设计生成式大模型背靠背攻防演练方案,形成数据飞轮 4.跟踪前沿生成式AI技术演进,预判新型安全风险并研发应对方案,优化检测算法性能和推理成本 5.协同产品、运营、法务、GA团队,保障新产品功能的安全合规与用户体验 【任职要求】 任职要求 1.计算机、人工智能相关专业硕士及以上学历,3年以上AI安全、内容风控或相关算法领域经验 2.具备以下至少一个领域经验:AIGC检测与识别技术、大模型安全与对齐研究、多模态内容理解与风控、对抗样本与攻防技术 3.熟悉大模型后训练 & agentic技术,熟悉生成式模型(扩散模型、LLM等)技术原理,有大规模数据处理经验 4.参与过大型互联网平台内容安全体系建设者优先,有算法落地的工程化经验者优先 5.在顶级会议发表相关论文或专利者优先

官网发布:2026-08-24 · 最后确认在招:2026-09-03 23:16:54 · 来源平台:xiaohongshu