vivo 社会招聘
具身智能算法专家 (VLA方向)
深圳 ·10年以上·硕士研究生
深圳
薪资面议
前往 vivo 官网投递
职位描述
岗位职责:
核心模型研发: 负责 Vision-Language-Action (VLA) 多模态大模型的架构设计、预训练及微调工作(如基于 RT-2, OpenVLA, pi05 等架构)。
数据管线建设: 负责构建高质量的机器人操作数据集,包括真实世界数据采集方案设计、仿真数据生成(Sim-to-Real)、以及视频/文本数据的清洗与配对。
算法优化: 探索大语言模型(LLM)与视觉编码器(ViT等)在机器人控制领域的融合,解决长序列决策、空间感知能力不足、以及推理延迟等关键问题。
前沿探索: 跟踪具身智能领域(如世界模型、端到端控制、强化学习与模仿学习结合)的最新论文,复现并改进 SOTA 算法。
落地验证: 将 VLA 模型部署到机械臂或人形机器人实体上,完成抓取、操作、导航等复杂任务的闭环测试。
任职要求:
学历背景: 计算机、人工智能、机器人等相关专业硕士及以上学历,博士优先;有顶会论文(CVPR, ICCV, ICRA, CoRL, NeurIPS 等)者优先。
模型经验: 深入理解 Transformer 与flow matching架构,有大规模多模态模型(如 CLIP, LLaVA, Flamingo)或VLA 模型的训练/微调经验。
具身智能背景: 熟悉模仿学习(Imitation Learning)、强化学习(RL)基本原理,了解 RT-1/RT-2, Aloha, PaLM-E 等具身智能经典工作。
编程能力: 精通 Python 及 PyTorch/JAX,具备优秀的工程实现能力,熟悉分布式训练框架(如 DeepSpeed, Megatron-LM)。
机器人基础: 了解刚体运动学、坐标变换、基础路径规划算法。
实战经验: 动手能力强,有机械臂(如 Franka, UR, 傲博等)或人形机器人开发经验者。
加分项:
有Isaac sim, Mujoco, Habitat 等仿真环境开发经验。
有实际物理机器人(机械臂、移动底盘、人形机器人)部署调试经验。
在 Kaggle 或机器人相关竞赛中获得优异名次。
熟悉 ALOHA / Mobile ALOHA 等开源硬件项目。
最后确认在招:2026-09-03 23:16:18 · 来源平台:vivo