直招.cv

← 返回职位列表

高德 社会招聘

高德-世界模型算法工程师-视觉团队

北京 ·3年以上·硕士

北京

职位描述

这个世界的运行机制是否是可计算的?世界的复杂性是否唯有用 AI 的复杂性来应对?人类是否可以造出一台机器,让未来就像过去一样历历在目? 这些问题正在从思辨走向科学。当视频生成模型开始隐式学会重力与碰撞,当 3D 场景合成可以补全从未被观测的视角,当 action-conditioned generation 让智能体在虚拟世界中试错而非在真实世界中付出代价——通用世界模型的轮廓已经浮现。它不只是下一代生成式 AI,而是对物理现实的可计算镜像:给定任意初始状态与动作序列,推演出符合物理规律的未来。 阿里巴巴旗下高德地图·视觉技术中心已经在这条路上深耕多年。我们拥有高德积累 20 年的海量真实时空数据,无限制的算力集群,以及一支在空间智能与生成式 AI 领域持续产出世界级成果的顶尖研究团队。 现在,我们需要你的加入——与我们一起,把「让机器理解并预演物理世界」从可能变为现实。 【岗位职责】 1. 参与通用世界模型核心算法研发,包括但不限于视频生成、3D 场景合成、物理仿真等方向; 2. 设计并优化大规模生成模型的训练与推理流程,在万卡集群上实现高效训练; 3. 构建数据飞轮——从海量真实时空数据中提取高质量训练信号,持续提升模型对物理世界的理解能力; 4. 将世界模型能力落地于自动驾驶仿真、导航场景预测、空间智能等实际业务场景。 【任职要求】 1. 计算机科学、人工智能、数学/物理等相关专业硕士及以上学历; 2. 扎实的深度学习能力,精通 PyTorch,具备千卡以上分布式训练实战经验; 3. 在以下至少一个方向有深入实践:视频生成(Diffusion/Autoregressive)、3D/4D 生成与重建(3DGS/LRM/3D Diffusion)、多模态大模型、强化学习、世界模型; 4. 熟悉主流生成模型架构(DiT、AR-DiT、Flow Matching、Diffusion Forcing 等),有从零搭建或深度改造经验者优先; 5. 良好的系统品味,能在算法创新与系统效率之间找到最优平衡。 【加分项】 1. 顶会论文发表(CVPR/ICCV/NeurIPS/ICML/ICLR 等); 2. 参与过知名世界模型/视频生成项目; 3. 有游戏引擎或物理仿真开发经验。

官网刷新:2026-09-02 · 最后确认在招:2026-09-03 22:51:36 · 来源平台:alibaba