蚂蚁集团 · 社会招聘
蚂蚁集团-数据湖存储引擎研发专家-杭州
杭州 ·3年以上·本科
杭州
薪资面议
前往 蚂蚁集团 官网投递
职位描述
1. 负责 RLake 数据湖存储引擎的核心模块研发,包括但不限于文件格式、元数据管理、读写优化、Schema Evolution 等;
2. 参与构建面向 AI 场景的统一存储服务,支持结构化(表数据)与非结构化(向量、文件、多模态)数据的统一存储与高效访问;
3. 深入 Flink / Spark 等计算引擎,优化数据湖在流式写入、批量读取、联邦查询等场景下的性能表现;
4. 参与跨语言 SDK(Python / C++ / Rust)的设计与开发,为上层 AI 和数据科学场景提供高性能访问接口;
5. 参与开源社区(Apache Paimon 等)的技术共建,跟进前沿数据湖技术趋势,将创新成果沉淀到产品中;
6. 负责线上稳定性保障,定位和解决生产环境中的性能瓶颈与疑难问题。
【任职要求】
1. 计算机基础知识扎实,精通引擎性能优化和问题定位;
2. 熟悉 Paimon / Hudi / Iceberg 其中一项引擎,对数据存储技术有深入的理解;
3. 熟悉 Flink / Spark / Ray 其中一项引擎,具备研发计算引擎源码的能力;
4. 熟练掌握 AI 的编程方式;
5. 自驱、结果导向,具备良好的协作和沟通能力,能够将技术方案落地为稳定、可维护的工程产物。
加分项
1. 有 Apache Paimon / Hudi / Iceberg 等数据湖开源社区贡献经验者优先;
2. 有 AI Infra、向量数据库、多模态数据存储相关经验者优先;
3. 熟悉C++,有跨语言系统编程经验者优先;
4. 有大规模数据生产环境(PB 级以上)调优和稳定性保障经验者优先。
最后确认在招:2026-09-01 19:09:33 · 来源平台:alibaba