字节跳动 校园招聘
LLM/VLM模型训练产品实习生 - AI数据与安全
北京 ·经验不限·学历不限
北京
薪资面议
前往 字节跳动 官网投递
职位描述
团队介绍:AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。
团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。
1、实验结果分析:通过对实验结果的研究,确定自研VLM的改进空间,以及相应的改进手段;
2、实验数据策略制定:基于模型训练方法与需求,制定并迭代含合成数据在内的整体数据构建策略,同步调研市场数据新趋势,为策略优化提供支撑;
3、实验数据产线搭建:设计数据生产链路及核心步骤,发起项目并主导全流程设计、优先级判定及项目管理,保障高效产出高质量数据;
4、评测集构建:面向自研VLM能力短板与迭代目标,设计评测维度与评估标准,构建高质量、可复用的评测集,完成论文撰写;
5、应用产品设计:与豆包C端用户体验及反馈相结合,设计并实现更有价值的产品功能。
【任职要求】
1、2027届硕士及以上学位在读,计算机科学与技术、数学、统计学、人工智能等相关专业;
2、有AI产品经验,具备LLM/VLM/多模态训练数据生产、评估经验;
3、具备优秀的逻辑思维、问题解决与创新能力,可快速学习新技术;拥有良好的团队协作与沟通能力,能在跨部门协作中高效推进项目。
加分项
1、具备扎实的机器学习、深度学习理论基础,熟悉深度学习框架,有模型训练与调优经验;
2、熟练掌握Python编程,具备良好的代码编写规范和工程实践能力,能够独立完成复杂算法的代码实现;
3、在ACL、ICLR、NeurIPS、CVPR等学术会议发表过有影响力研究成果、在ACM、Kaggle等编程或AI竞赛中获奖、主导或参与过具有影响力的AI开源或闭源项目者优先。
官网发布:2026-04-20 · 最后确认在招:2026-09-03 19:26:41 · 来源平台:feishu