高德 社会招聘
高德-世界模型算法工程师-视觉团队
北京 ·3年以上·硕士
北京
薪资面议
前往 高德 官网投递
职位描述
这个世界的运行机制是否是可计算的?世界的复杂性是否唯有用 AI 的复杂性来应对?人类是否可以造出一台机器,让未来就像过去一样历历在目?
这些问题正在从思辨走向科学。当视频生成模型开始隐式学会重力与碰撞,当 3D 场景合成可以补全从未被观测的视角,当 action-conditioned generation 让智能体在虚拟世界中试错而非在真实世界中付出代价——通用世界模型的轮廓已经浮现。它不只是下一代生成式 AI,而是对物理现实的可计算镜像:给定任意初始状态与动作序列,推演出符合物理规律的未来。
阿里巴巴旗下高德地图·视觉技术中心已经在这条路上深耕多年。我们拥有高德积累 20 年的海量真实时空数据,无限制的算力集群,以及一支在空间智能与生成式 AI 领域持续产出世界级成果的顶尖研究团队。
现在,我们需要你的加入——与我们一起,把「让机器理解并预演物理世界」从可能变为现实。
【岗位职责】
1. 参与通用世界模型核心算法研发,包括但不限于视频生成、3D 场景合成、物理仿真等方向;
2. 设计并优化大规模生成模型的训练与推理流程,在万卡集群上实现高效训练;
3. 构建数据飞轮——从海量真实时空数据中提取高质量训练信号,持续提升模型对物理世界的理解能力;
4. 将世界模型能力落地于自动驾驶仿真、导航场景预测、空间智能等实际业务场景。
【任职要求】
1. 计算机科学、人工智能、数学/物理等相关专业硕士及以上学历;
2. 扎实的深度学习能力,精通 PyTorch,具备千卡以上分布式训练实战经验;
3. 在以下至少一个方向有深入实践:视频生成(Diffusion/Autoregressive)、3D/4D 生成与重建(3DGS/LRM/3D Diffusion)、多模态大模型、强化学习、世界模型;
4. 熟悉主流生成模型架构(DiT、AR-DiT、Flow Matching、Diffusion Forcing 等),有从零搭建或深度改造经验者优先;
5. 良好的系统品味,能在算法创新与系统效率之间找到最优平衡。
【加分项】
1. 顶会论文发表(CVPR/ICCV/NeurIPS/ICML/ICLR 等);
2. 参与过知名世界模型/视频生成项目;
3. 有游戏引擎或物理仿真开发经验。
官网刷新:2026-09-02 · 最后确认在招:2026-09-03 22:51:36 · 来源平台:alibaba