字节跳动 校园招聘
Agent评测实习生 - AI数据与安全
北京 ·经验不限·学历不限
北京
薪资面议
前往 字节跳动 官网投递
职位描述
团队介绍:AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。
团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。
日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
1、负责Agent系统的全维度评测工作,覆盖文本生成、信息检索、多模态等多个能力方向,结合业务场景设计评测方案,统筹管理评测任务与外包资源,持续提升评测效率与质量标准;
2、重点负责Agent效果评估,聚焦工具调用(Skill)准确性、检索结果相关性、多模态内容理解质量、任务规划合理性、推理链完整性等核心评测维度搭建;
3、建立科学、多元的Agent评测方法论与指标体系,推进自动化评测框架落地,确保对Agent核心能力进行高效、精准评估,助力Agent模型核心能力持续提升;
4、深入理解业务场景、市场动态及Agent技术趋势,牵引数据团队与算法、产品团队深度融合,推动评测体系与业务需求、技术迭代同频;
5、输出高质量评测报告,沉淀评测方法论与最佳实践,为产品决策和技术优化提供数据支撑。
【任职要求】
1、本科及以上学历在读,专业背景不限;
2、具备跨学科知识储备与多元视角者优先;具备AI产品、大模型或Agent相关评测/运营/产品经验,熟悉Agent工作原理与Skill/工具调用逻辑,对检索质量、多模态内容有较好的判断力,具备从评测设计到报告输出的完整经验者优先;
3、具备较强的逻辑推理与问题拆解能力,能搭建适配Agent能力维度的评估体系,擅长从评测结果中挖掘产品改善建议并推动落地。
官网发布:2026-07-03 · 最后确认在招:2026-09-03 19:26:41 · 来源平台:feishu