直招.cv

← 返回职位列表

vivo 社会招聘

算法数据工程师/专家(多模态大模型 & 影像方向)

杭州 ·3年以上·硕士研究生

上海·杭州

职位描述

职位背景: vivo致力于通过前沿的AI技术重新定义移动影像体验。我们正在构建下一代影像算法Agent及多模态大模型(MLLM),旨在让手机不仅“看得清”,更能“看得懂”并智能辅助创作。我们需要一位在数据领域有深厚造诣的专家,负责统筹整个训练数据管线,从源头掌控模型的核心竞争力。 核心职责 (Responsibilities): 数据管线架构设计: 负责多模态大模型(图文、视频、3D)及影像Agent训练全流程的数据管线架构设计与搭建,包括数据采集、清洗、标注、配对、评估及版本管理。 建设高吞吐、低延迟的数据处理平台,支持PB级影像数据的自动化处理与流转。 数据策略与质量体系: 制定符合影像美学、语义理解及Agent决策逻辑的数据标准(Data Curation)。 设计数据质量评估体系,通过自动化脚本与专家审核机制,解决Bad Case,提升SFT(监督微调)和后训练的数据质量。 针对影像垂直领域(如夜景、人像、运动抓拍等),构建高质量的Instruction Tuning(指令微调)数据集。 合成数据与AIGC应用: 探索利用Diffusion模型、3D引擎(Unreal/Unity)或现有大模型生成高质量的合成数据,解决长尾场景及极端环境的数据匮乏问题。 设计“模型反哺数据”的闭环机制,利用模型能力进行自动化数据清洗和标注。 跨团队协作: 与算法研究员紧密配合,根据Scaling Law和模型训练反馈,动态调整数据配比与分布策略。 协同工程团队优化数据加载(Data Loader)效率,减少GPU闲置时间。 任职要求 (Qualifications): 必备技能: 学历背景: 计算机、人工智能、数学或相关专业硕士及以上学历。 各种经验: 3-5年以上数据工程或AI算法相关经验,至少有1个完整的大模型(LLM/MLLM)或大型CV项目的数据管线落地经验。 编程能力: 精通Python,熟练使用PyTorch/TensorFlow,熟练使用vibe coding。 数据工程: 熟悉分布式数据存储与处理技术。 多模态理解: 深刻理解多模态模型(如CLIP, BLIP, LLaVA, qwen)的数据需求,熟悉图文对齐、Caption生成、VQA等数据构建方法。 加分项 (Preferred Qualifications): 影像背景: 有计算摄影、ISP算法、图像增强或手机影像相关业务经验者优先。 Agent经验: 了解Function Calling、ReAct框架,有构建Agent相关数据集(如API调用序列数据)经验者优先。 美学素养: 对摄影美学有独到见解,能定义“高质量影像”的数据标准。 论文/竞赛: 在CVPR, ICCV, ECCV, NeurIPS等会议发表过数据中心化(Data-centric AI)相关论文,或在公开数据集竞赛中获奖。

最后确认在招:2026-09-02 22:04:40 · 来源平台:vivo