阿里巴巴控股集团 · 社会招聘
数据技术及产品部-大模型安全对抗专家-杭州
杭州 ·2年以上·本科
杭州
薪资面议
前往 阿里巴巴控股集团 官网投递
职位描述
1.主导集团大模型安全与对抗防御体系的构建:结合多模态、Agent、具身智能等前沿业务场景,负责大模型全链路(预训练数据防投毒/SFT对齐/RLHF/推理部署)的安全对抗演练、漏洞挖掘及红蓝对抗算法优化。
2.负责构建基于多模态与Agentic的自动化红队攻击体系:设计并研发基于强化学习、进化算法或多Agent协同的自动化越狱、提示词注入和对抗性扰动生成算法,实现对多模态模型的高并发、深层次安全边界压力测试。
3.负责大模型安全对齐与安全护栏算法的研发:研究并落地基于RLAIF、DPO、KTO等前沿对齐技术;设计并迭代高性能、低延迟的输入/输出内容安全过滤模型与多维风险评估机制,保障生成内容符合安全合规标准。
4.负责攻克大模型深层漏洞与新型威胁防御:针对间接提示词注入、数据投毒、偏好劫持及版权/隐私泄露等高阶安全威胁,研发对应的算法检测器与鲁棒性增强方案。
5.主导自动化对抗消融实验与防御价值验证闭环:设计高精度、轻量化的多维安全评测Benchmark与自动化对抗博弈平台,通过算子智能编排实现7*24H的“攻击自动生成-防御实时阻断-模型快速微调”的安全对抗迭代闭环。
【任职要求】
1.计算机、网络安全、人工智能等相关专业硕士及以上学历,具备扎实的大模型安全、AI对抗样本、密码学或传统Web安全背景,拥有成熟的模型红队测试或对齐算法落地经验。
2.熟练掌握PyTorch等深度学习框架,在Transformer架构、大模型微调(PEFT/SFT)、RLHF/DPO对齐、强化学习等至少一个领域有深入的算法落地经验。
3.熟悉大模型主流安全漏洞与绕过机制,有基于LLM-as-a-Judge的安全评估框架研发经历,或熟悉多模态对抗样本生成、黑盒/白盒对抗攻击算法者优先。
4.具备优秀的数学建模与安全策略设计能力,熟悉海量攻击等特征工程,对分布式训练、大规模红队自动化工程化实现及推理加速优化有深刻理解。
5.具备强烈的技术创新意识、极客精神与自驱力,精通Python/C++/Go等至少一种编程语言,能高效协同工程、合规与各业务大模型团队,推动“漏洞挖掘-安全防御-对齐训练”全流程迭代。
6.在安全或人工智能顶级会议/期刊(CVPR,NeurIPS,ICLR,ACL等)发表过高水平安全对抗/AI安全方向论文,或在知名AI比赛、大模型安全挑战赛中获得优异成绩,或有大型开源AI安全项目贡献经历者优先。
最后确认在招:2026-09-01 19:10:48 · 来源平台:alibaba