直招.cv

← 返回职位列表

vivo 社会招聘

图像算法工程师/专家(多模态大模型及Agent研发方向)

杭州 ·5年以上·硕士研究生

上海·杭州

职位描述

关于我们 我们是vivo公司内部致力于“多模态感知理解”的前沿技术团队。我们的使命是推动影像体验从“被动记录”进化为“主动智能”。我们正在构建下一代影像Agent,它将作为用户的智能影像伙伴,深度理解用户的意图与情感,提供从拍摄、编辑到分享的全链路智能服务。 岗位职责 负责影像Agent核心推荐模块的设计与落地:深度参与影像Agent的意图理解与服务推荐,利用多模态大模型技术,让Agent能精准预判用户需求,主动推荐拍摄建议、创作玩法等。 打造智能相册的创作推荐引擎:基于对照片、视频内容的多维度理解(如美学、情感、事件),为用户在相册编辑场景中,智能推荐个性化的模板、音乐、滤镜及包装特效,引爆创作灵感。 主导影像社交App的内容分发与推荐:负责vivo旗下影像社交平台的内容推荐流,结合用户行为和多模态内容理解,探索前沿的推荐模型,提升优秀作品的曝光率、分发效率与用户粘性。 探索前沿技术的应用与创新:跟进多模态大模型、生成式推荐、Agent等领域的最新进展,结合业务场景进行技术预研和方案设计,持续构筑vivo在智能影像推荐领域的技术壁垒。 任职要求 计算机、人工智能、模式识别等相关专业硕士及以上学历,3年以上推荐系统相关研发经验。 熟悉协同过滤、CTR预估、召回与排序等主流推荐算法,有大规模推荐系统(如信息流、短视频、电商推荐)的落地经验。 核心要求:对多模态大模型(如CLIP, BLIP, LLaVA等)有深入理解,并拥有将多模态表征(Embedding)与推荐系统相结合的实际项目经验。 编程基础扎实,熟练掌握Python,并精通至少一种深度学习框架(PyTorch/TensorFlow)。 具备优秀的数据分析和问题解决能力,能够主动发现问题,并通过技术手段驱动业务增长。 具备良好的沟通协作能力和团队精神,有强烈的责任心和技术热情。 加分项 有MLLM与推荐系统结合的经验者优先。 熟悉LLM(大语言模型)在推荐或Agent系统中的应用(如Tool-use, ReAct)者优先。 在计算机视觉(CV)或推荐系统(RecSys)等领域的顶级会议(如CVPR, ICCV, KDD, SIGIR)发表过论文者优先。 对摄影或视频创作有浓厚兴趣,是影像产品的深度用户。

官网发布:2026-02-28 · 最后确认在招:2026-09-02 22:04:40 · 来源平台:vivo