直招.cv

← 返回职位列表

阿里云智能 · 社会招聘

瓴羊-AI数据研发工程师-杭州

杭州 ·3年以上·本科

杭州

职位描述

关于团队 我们是瓴羊One 经营参谋技术团队,业务覆盖电商智能运营等核心场景,用 Agent + 大模型重塑商家的"看店、问数、做内容、做决策"全链路。 Agent 能不能被信任,最终取决于它读到的数据对不对、快不快、懂不懂业务。所以数据研发在这里不是"提供表"的角色:你要建的是面向 Agent 的数据语义层——让指标口径、维度关系、业务规则以智能体可理解、可调用、可推理的形式沉淀下来。我们离业务足够近,也离模型足够近,链路完整、决策空间大。 你将负责 1、面向 Agent 的数据语义层建设:参与并主导语义层的设计与落地,推动数据资产从"一堆表"演进为智能体可理解、可调用、可推理的消费形态(语义模型、统一指标口径、元数据与工具化接口),支撑 Text2SQL / 问数 / 分析助手等场景; 2、端到端建模与交付:负责核心业务域的数仓分层与模型设计(ODS/DWD/DWS/ADS),基于流批一体架构(Flink + Spark/MaxCompute + Paimon)完成实时与离线链路的统一构建、开发与上线,对交付结果负责; 3、实时计算攻坚:主导 Flink 实时链路建设,覆盖 CDC 接入、多流 Join、维表关联、状态管理与 Exactly-Once 保障;独立处理反压、数据倾斜、Checkpoint 失败、状态膨胀等线上问题; 4、质量治理与稳定性保障:建设覆盖全链路的监控告警、基线、DQC 规则与血缘追踪,确保关键数据任务满足 SLA;参与故障应急与复盘改进; 5、成本与研发效能:负责计算/存储资源治理与任务性能优化,沉淀研发规范、模板与自动化工具,让治理靠机制而不靠人肉巡检。 我们提供 真实场景:服务百万级商家,数据链路每天被业务、被 Agent 真实调用与拷问;完整链路:从接入、建模、语义层、服务到治理与评测,技术栈不"半成品";决策空间:技术选型与架构演进有充分话语权,团队鼓励"先发起、再讨论";成长加速:与一线大模型、Agent 框架团队紧密协作,定期内部技术分享。 【任职要求】 1、本科及以上学历,计算机、数学、统计学、信息管理等相关专业优先;3 年以上大数据研发经验,有完整数仓从 0 到 1 或大规模重构的落地经历; 2、扎实的编程与工程能力:精通 SQL(复杂查询优化、建模方法论),熟练掌握 Java 或 Python 至少一种,代码干净、可测试、可演进; 3、精通 Hadoop 生态:深入理解 HDFS / YARN / Hive / Spark 的原理与调优(分区分桶、小文件、Shuffle、内存与并行度、慢任务定位),能读执行计划并给出优化方案;熟悉 Kafka、HBase、Paimon / Hudi / Iceberg 的适用边界; 4、精通 Flink:熟悉运行时机制(Time & Watermark、State & Checkpoint、算子链与资源模型),具备 SQL + DataStream 双栈开发经验,独立支撑过高吞吐或低延迟的线上实时链路; 5、数据资产意识强:对元数据管理、数据血缘、数据标准、质量规则有深入理解或实战经验,能把治理能力产品化、自动化; 6、业务理解与抽象能力:能精准识别需求本质,将其转化为可复用的数据模型与服务接口,能独立对接业务方并推动落地; 7、具备 Vibe Coding 能力(必须):能熟练借助 AI 编程工具(如 Cursor、GitHub Copilot 等)完成需求分析、SQL / 任务代码生成、重构与 Review,把 AI 辅助编程融入日常研发工作流; 8、对 LLM + Data、AI Agent、语义建模等前沿方向有浓厚兴趣,能快速掌握新技术并在复杂系统中验证落地;沟通顺畅、责任心强、擅长跨团队协同。、 加分项 有湖仓一体(Paimon / Hudi / Iceberg)或流批融合的生产级落地经验;有指标平台、元数据/血缘平台、数据质量平台等数据工具建设经验;有 MaxCompute / DataWorks 等云上数据体系的大规模使用与治理经验;有 Text2SQL / RAG / MCP 等 Data + AI 方向的实践产出;有电商、内容、直播、SaaS 等垂直领域业务背景,理解商家经营场景;活跃的开源贡献或技术影响力(Commit、议题分享、专利/论文)。

最后确认在招:2026-09-01 19:10:00 · 来源平台:alibaba