阿里巴巴控股集团 · 社会招聘
集团安全部-安全大模型评测与增强算法专家-北京&杭州
杭州 ·1年以上·硕士
北京·杭州
薪资面议
前往 阿里巴巴控股集团 官网投递
职位描述
1、负责建设面向安全场景的大模型评测体系,涵盖通用能力评测与安全业务场景定制评测,构建基于LLM-as-Judge、自动化评测模型训练与人工评估相结合的多维度评测框架,保障评测结果的全面性和可靠性
2、建设基于真实安全攻防场景的Agentic评测环境,构建面向安全长程任务的Agentic评测,提升大模型在安全场景的Agentic能力
3、跟踪业界主流安全大模型评测方法与Benchmark动态,持续优化内部评测体系,对标行业前沿能力水平,发布开源评测集
4、深度参与大模型迭代过程中的知识与评测驱动优化,建设“评测归因分析→知识短板发现→训练数据生产→模型训练增强→评测反馈验证”的高效自进化闭环,以评测数据反哺训练,用领域知识增强训练数据,持续提升模型在安全场景中的能力表现
【任职要求】
1、计算机、人工智能、信息安全或相关专业硕士及以上学历,1年以上大模型研发相关工作经验
2、精通大模型基本原理与训练方法,了解常见攻击手法、防御机制、日志分析或漏洞原理,有安全业务经验优先
3、熟悉安全主流Benchmark与评测框架,有Rubrics评测、Arena对战评测等评测方法实践经验者优先
4、具备优秀的结构化思维和数据分析能力,能够从评测数据中提炼模型短板、定位根因、驱动优化方向,善于沟通和跨团队协作
5、动手能力强,具备优秀的工程落地实现能力,熟悉Agentic评测沙箱搭建者优先
6、在大模型、AI或安全顶会(ICLR/NeurIPS/ACL/EMNLP/USENIX Security等)以第一作者身份发表过论文优先
7、加分项:有大模型数据合成或评测经验优先
最后确认在招:2026-09-01 19:10:48 · 来源平台:alibaba