vivo 社会招聘
算法数据工程师/专家(多模态大模型 & 影像方向)
杭州 ·3年以上·硕士研究生
上海·杭州
薪资面议
前往 vivo 官网投递
职位描述
职位背景:
vivo致力于通过前沿的AI技术重新定义移动影像体验。我们正在构建下一代影像算法Agent及多模态大模型(MLLM),旨在让手机不仅“看得清”,更能“看得懂”并智能辅助创作。我们需要一位在数据领域有深厚造诣的专家,负责统筹整个训练数据管线,从源头掌控模型的核心竞争力。
核心职责 (Responsibilities):
数据管线架构设计:
负责多模态大模型(图文、视频、3D)及影像Agent训练全流程的数据管线架构设计与搭建,包括数据采集、清洗、标注、配对、评估及版本管理。
建设高吞吐、低延迟的数据处理平台,支持PB级影像数据的自动化处理与流转。
数据策略与质量体系:
制定符合影像美学、语义理解及Agent决策逻辑的数据标准(Data Curation)。
设计数据质量评估体系,通过自动化脚本与专家审核机制,解决Bad Case,提升SFT(监督微调)和后训练的数据质量。
针对影像垂直领域(如夜景、人像、运动抓拍等),构建高质量的Instruction Tuning(指令微调)数据集。
合成数据与AIGC应用:
探索利用Diffusion模型、3D引擎(Unreal/Unity)或现有大模型生成高质量的合成数据,解决长尾场景及极端环境的数据匮乏问题。
设计“模型反哺数据”的闭环机制,利用模型能力进行自动化数据清洗和标注。
跨团队协作:
与算法研究员紧密配合,根据Scaling Law和模型训练反馈,动态调整数据配比与分布策略。
协同工程团队优化数据加载(Data Loader)效率,减少GPU闲置时间。
任职要求 (Qualifications):
必备技能:
学历背景: 计算机、人工智能、数学或相关专业硕士及以上学历。
各种经验: 3-5年以上数据工程或AI算法相关经验,至少有1个完整的大模型(LLM/MLLM)或大型CV项目的数据管线落地经验。
编程能力: 精通Python,熟练使用PyTorch/TensorFlow,熟练使用vibe coding。
数据工程: 熟悉分布式数据存储与处理技术。
多模态理解: 深刻理解多模态模型(如CLIP, BLIP, LLaVA, qwen)的数据需求,熟悉图文对齐、Caption生成、VQA等数据构建方法。
加分项 (Preferred Qualifications):
影像背景: 有计算摄影、ISP算法、图像增强或手机影像相关业务经验者优先。
Agent经验: 了解Function Calling、ReAct框架,有构建Agent相关数据集(如API调用序列数据)经验者优先。
美学素养: 对摄影美学有独到见解,能定义“高质量影像”的数据标准。
论文/竞赛: 在CVPR, ICCV, ECCV, NeurIPS等会议发表过数据中心化(Data-centric AI)相关论文,或在公开数据集竞赛中获奖。
最后确认在招:2026-09-02 22:04:40 · 来源平台:vivo