直招.cv

← 返回职位列表

高德 社会招聘

高德-ABot-M具身操控大模型算法工程师/专家-视觉技术中心

北京 ·1年以上·硕士

北京

职位描述

高德地图视觉技术中心(AMAP CV Lab) 高德地图日均服务数亿用户,每日处理超百亿级位置与视觉数据。视觉技术中心是高德的核心技术引擎,视觉技术中心是高德的核心技术引擎,深耕空间智能、具身智能、世界模型等AGI前沿方向。我们的核心使命:以空间智能为锚点,打造物理世界的智能体操作系统 ABot。我们不做“刷榜模型”,而是打造能在开放世界中自主决策、安全执行、持续进化的智能体系统。你的研究,将直接改变数亿人的出行方式。 GitHub 主页:https://github.com/amap-cvlab 我们的优势:独一无二的“空间智能-场景-生态”三角 ● 空间智能深度:全栈覆盖三维重建、世界模型、多模态、具身导航、LLM/VLM/VLA/AI Agent,所有技术都服务于“让AI理解并作用于物理空间”。 ● 场景广度:亿级用户真实验证,从封闭测试到开放街道,技术必须经得起现实世界的“毒打”,空间智能不能只存在于实验室。 ● 生态高度:清华大学、北京大学、港科、中科院等深度合作,主导开源标准,你不是孤军奋战,而是站在全球空间智能研究的前沿。 我们正在寻找在视觉-语言-动作(Vision-Language-Action, VLA)领域具有扎实理论基础和丰富实践经验的算法工程师或研究员,致力于构建下一代通用智能机器人系统。你将参与从数据构建、模型设计到仿真训练与实机部署的全链路研发,推动 VLA 大模型在机械臂操作、人形机器人控制等复杂工业与开放场景中的前沿探索与实际落地。 岗位职责: 1、研发下一代 ABot-M,探索 VLA/WAM、多模态生成与理解、跨本体动作表示。 2、统一世界建模、动作预测与价值判断,提升长时序、精细操作、移动操作和双臂任务能力。 3、建设机器人数据引擎,完成清洗、动作统一、混合训练、合成数据与真机数据闭环。 4、推进模仿学习、强化学习、奖励模型、失败恢复与在线后训练。 5、打通训练、评测、仿真和真机部署,把算法转化为真实产品与行业影响力。 【任职要求】 1、在 VLA/WAM、机器人学习、视频/世界模型、多模态大模型、强化学习、3D 视觉或控制中至少有两个方向的深度积累。 2、能亲手完成模型设计、训练、调试与实验闭环,熟悉 PyTorch 和大规模训练。 3、重视数据质量、评测可信度和真机成功率,能从失败案例定位系统问题。 4、对 Physical AGI 有长期信念,兼具原创判断与工程落地能力。 加分项: 1、在模型、系统、开源项目或真实机器人产品中做出过可验证的关键贡献。 2、能够综合模型、数据、算力和真机约束,形成清晰、可迭代的技术方案。 3、乐于与研究、工程、硬件和产品团队协作,共同解决复杂问题。

官网刷新:2026-09-01 · 最后确认在招:2026-09-03 22:51:36 · 来源平台:alibaba