vivo 社会招聘
多模态视觉理解与生成算法专家(杭州&上海)
杭州 ·5年以上·硕士研究生
上海·杭州
薪资面议
前往 vivo 官网投递
职位描述
工作职责:
1、负责人像摄影场景拍摄智能体(Agent)的算法框架设计与优化;
2、主导多模态视觉感知与理解相关大模型(VLM / CLIP等)的算法设计、开发及效果优化;
3、推动大型语言模型(LLM)在摄影场景下的推理与建议能力提升;
4、结合强化学习机制(RLAIF),提升智能体的推理与建议效果;
5、负责AIGC图像生成与编辑相关算法在业务场景中的应用优化与性能提升。
职位要求:
1、精通深度学习与图像处理算法,具备扎实的编程能力,熟练使用Python;
2、拥有丰富的多模态理解与生成算法研发经验,熟悉CLIP、VLM、LLM、RLHF、RLAIF、智能体(Agent)、SD、AIGC等技术,具备出色的算法实现与优化能力;
3、具备良好的团队协作与沟通能力,能有效理解业务需求,并协同推进项目执行。热爱技术创新,具有自我驱动力和快速学习能力;
4、有顶级会议论文发表经历或博士学位者优先考虑。
最后确认在招:2026-09-02 22:04:40 · 来源平台:vivo