字节跳动 校园招聘
VLM数据运营实习生(世界模型) - AI数据与安全
成都 ·经验不限·学历不限
成都·北京
薪资面议
前往 字节跳动 官网投递
职位描述
团队介绍:AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。
团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。
日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
1、深度参与世界模型训练所需视频、图像的数据生产及标注全流程,基于模型能力边界与训练目标,输出视觉数据标注策略及标准,支撑图像、视频数据资产的规模化交付;
2、负责对接数据供应商及数据标注团队,明确任务需求,把控任务交付进度及质量,独立完成项目交付;设计并优化高质量多模态(文本、图像、视频、3D资产)数据集的构建流程,主导清洗、标注、SFT及RL的数据策略设计;
3、基于摄影、剪辑、绘图、3D建模或视觉设计等实操经验,完成图像、视频素材的标准化处理及标注,实现自动化数据处理链路,探索合成数据的生成策略;
4、具备一定代码能力,能够利用Python或其他编程语言实现标注辅助(如数据提取、数据质检、格式校验等),提升人工标注效率与一致性;
5、结合世界模型场景,参与Prompt策略设计与效果验证,提升模型生成结果的可控性与语义对齐度。
【任职要求】
1、本科及以上学历在读,数字媒体、计算机、人机交互、图形学等计算机相关交叉学科专业背景优先;
2、具备优秀的视觉感知力、结构化表达能力,逻辑清晰、表达严谨,拥有跨职能协作意识与快速学习能力;熟悉摄影、视频剪辑、数字绘画、3D建模、主流游戏引擎(UE/Unity)、3D空间逻辑、物理引擎仿真,掌握至少1类主流视觉内容生产工具(如Photoshop、Premiere、Blender、Procreate等);能从创作视角理解画面构成、光影逻辑与语义层次;
3、理解大模型基础原理(如Transformer架构、SFT/RLHF训练范式),持续追踪AIGC前沿进展;具备基础编程能力(Python优先),可通过脚本辅助完成数据清洗、数据标注、格式校验等自动化任务;
4、有面向大模型训练的数据标注、描述撰写或质量校验项目经历者优先;能主动识别数据偏差(如描述模糊、细节遗漏、逻辑断裂)并提出可落地的优化建议;熟悉Prompt Engineering基本方法。
官网发布:2025-12-17 · 最后确认在招:2026-09-03 19:26:41 · 来源平台:feishu