直招.cv

← 返回职位列表

蚂蚁集团 · 社会招聘

蚂蚁集团-大模型安全研究员-杭州

杭州 ·1年以上·硕士

杭州

职位描述

大模型能力正在向自主决策、多模态交互等前沿边界升级演变的同时,前沿风险同时在催生。我们的任务是从原理层面发现和定义新 型AI风险,构建前沿评测与防御体系,输出高质量研究成果(如顶会论文、技术白皮书等)并推动真实业务场景安全实践落地(如蚂蚁阿福、蚂小财、灵光、阿 宝等战略级Native AI产品)。研究方向包括但不限于: - 新型AI风险评测:面向 Agentic AI 自主行动等场景,发现并定义新型风险类别(如多轮内生安全对齐可靠性、虚实结合的具身智能风险等),设计前沿风险评测体系和benchmark; - 安全对齐与可控性研究:探索 RLHF、DPO、Constitutional AI 等对齐方法在 Agentic AI 场景的适配与演进,研究对齐有效性与持久性,应对微调退化、对齐税、自主行动偏离等前沿挑战; - 可解释性与风险归因:研究大模型及智能体的决策可解释性方法,构建面向自主行动场景的风险归因与实时阻断机制,支撑可审计、可追溯、可干预 的AI治理体系。 【任职要求】 - 硕士及以上学历,计算机、人工智能、信息安全、数学等相关专业,博士优先; - 1年以上机器学习、自然语言处理等相关领域工作经验,有安全/对齐/评测方向研究或工程实践优先; - 对 Transformer 架构与大模型训练流程有深入理解,熟悉 SFT、RLHF、DPO 等后训练方法; - 在 AI 安全、对齐、评测、可解释性任一方向有深入研究成果,有顶会论文(NeurIPS、ICML、ICLR 等)优先; - 具备技术洞察力与问题拆解能力,善于从复杂业务场景中提炼可研究的技术命题;能推动跨团队协作将研究成果落地。

最后确认在招:2026-09-01 19:09:33 · 来源平台:alibaba