直招.cv

← 返回职位列表

小鹏汽车 社会招聘

全栈云端计算平台工程师

广州 ·经验不限·学历不限

广州

职位描述

职位描述 1. 负责小鹏集团计算平台的架构设计与研发落地,构建云端模型开发,训练基础设施以及大规模数据生产基础设施; 2. 设计并实现高性能数据编排与加载系统,支撑 PB 级多模态数据(文本、图像、视频、点云、传感器等)的高效处理、缓存加速,支持批式与流式数据生产;深度集成AI Coding Agent与 Data Pipeline,实现数据准备、清洗、标注、版本管理的自动化与智能化闭环; 3. 负责云原生基础设施层的开发与优化,包括 GPU集群调度、弹性资源管理、容器化训练/推理工作负载编排,持续提升资源利用率与系统吞吐; 4. 可以承担全栈职责,包括前端管理控制台到后端分布式服务的开发。 职位要求 1. 计算机 / 软件工程 / 数学 / 自动化等相关专业硕士及以上学历,或具备同等技术能力;3 年及以上后端/基础设施开发经验,其中 2 年及以上大规模 AI 平台或分布式系统研发经验; 2. 精通Python,具备出色的工程化能力;熟练使用 Golang/Java/C++ 中至少一门语言进行系统性开发; 3. 熟悉 AI Coding / AI Agent 相关工具体系,日常使用 Copilot / Cursor / Claude Code / Codex CLI 等辅助开发,了解 Agentic Coding 工作流(MCP 协议、Function Calling、Sandbox 执行等),能将其融入平台工程实践; 4. 具备完整全栈能力:熟悉至少一个前端框架(React / Vue),能独立开发管理控制台、可视化监控面板等前端界面; 5. 云原生与分布式系统:深入掌握 Kubernetes 编排(Pod/Job/CRD/Operator); 6. 优秀的跨团队沟通与协作能力,Owner 意识强,善于在模糊需求中定义问题、拆解路径并推动落地。 加分项 1. 有 AI Infra 开源项目贡献经历(如 vLLM、Triton、Ray、Kubeflow、Volcano、Fluid 等),或维护过有一定 Star 数的后端/基础设施项目; 2. 熟悉模型训练/推理全流程——分布式训练策略(FSDP/DeepSpeed/Megatron)、GPU 显存优化(FlashAttention/PagedAttention)、推理加速(TensorRT/vLLM/SGLang); 3. 对以下任一领域有深入理解: a. 数据仓库与数据湖体系(Hadoop/Hive/Spark/Flink/Iceberg); b. 高性能计算网络(RDMA/RoCE/InfiniBand)及集合通信库(NCCL/RCCL); 4. 掌握关系型数据库(PostgreSQL/MySQL)与 NoSQL(Redis/MongoDB/Elasticsearch); 5. 熟悉至少一种流/批处理引擎(Spark/Flink/Ray Data),理解数据分区、Shuffle、Checkpoint 等机制; 6. 熟悉数据加载与预处理管线,熟悉 Parquet/lance 列式存储及向量化读取优化.

官网发布:2026-05-29 · 最后确认在招:2026-09-03 19:36:58 · 来源平台:feishu