直招.cv

← 返回职位列表

蚂蚁集团 社会招聘

蚂蚁集团-非结构化数据挖掘工程师-具身智能方向

上海 ·3年以上·硕士

上海

职位描述

1. 数据挖掘与核心场景挖掘:处理和分析大规模、多源的非结构化数据,重点聚焦具身智能场景下的机器人传感器轨迹数据、视频数据和深度数据;设计并实施数据清洗、过滤流程,结合数据预处理与增强手段,确保数据质量;专项负责关键帧/关键片段挖掘,精准提取数据中的核心有效信息,适配具身智能算法训练需求;开展困难样本挖掘工作,结合持续学习(Continuous Learning)理念,挖掘模型训练所需的高价值困难样本,助力具身智能模型性能迭代升级。 2. 特征工程与向量数据库建设:针对具身智能场景下的不同模态数据,研究和应用先进的多模态数据表征方法,实现跨模态信息的对齐、融合与联合表征,构建统一的向量表征体系;负责向量数据库的设计、搭建与优化,实现跨模态统一表征的高效存储、检索与管理,支撑具身智能下游算法快速调用;运用和优化经典及前沿的聚类算法,从非结构化数据中挖掘潜在模式、群体特征及异常信息,为具身智能算法任务提供高质量特征支撑。 3. 数据标签体系建设:主导或深度参与具身智能特定业务场景的数据标签体系设计、优化与迭代,结合具身智能算法训练、产品落地需求,定义标签标准、分类规则及标注规范,确保标签体系的科学性、实用性和可扩展性,全面支撑具身智能算法训练与产品化落地。 4. 标准数据集建设与发布:建立标准化的数据发布管道,整合清洗过滤后的数据、提取的特征集及相关模型,实现数据集的版本化管理、安全管控与高效交付,确保高质量数据能够安全、高效地服务于内部算法团队训练、模型微调及具身智能产品化需求。 5. 技术探索与落地:关注具身智能领域多模态数据挖掘、持续学习、大模型微调等前沿技术,结合业务场景进行技术探索与实践;配合算法团队完成具身智能相关数据的技术支持,推动技术成果落地应用,提升具身智能模型的数据适配能力。 【任职要求】 1. 学历与工作经验:计算机科学、人工智能、统计学或相关领域硕士及以上学历,3年以上数据挖掘相关工作经验;智驾数据挖掘相关经验者优先,有具身智能领域数据挖掘经验者优先。 2. 核心技能:具备丰富的非结构化数据处理实操经验,熟练处理视频数据、深度数据、轨迹数据;深刻理解多模态表征学习理念,熟练使用常见聚类算法;精通数据清洗、过滤流程,具备关键帧/关键片段挖掘、困难样本挖掘相关实操经验,能适配具身智能场景数据需求。 3. 专项能力:具备向量数据库建设经验,熟练掌握跨模态统一表征的设计与实现方法;对数据标签体系的设计、优化和数据发布流程有清晰的理解和实践经验,能够独立主导或深度参与具身智能场景下标签体系搭建。 4. 加分项:具备大模型微调经验者优先;熟悉具身智能或智驾场景下的数据特点、业务需求及算法训练流程者优先;具备良好的问题解决能力、沟通协调能力和团队协作精神,能够高效推进具身智能相关数据挖掘项目落地。

官网刷新:2026-09-03 · 最后确认在招:2026-09-03 22:49:08 · 来源平台:alibaba