直招.cv

← 返回职位列表

Token Foundry · 校园招聘

算法工程师-数据算法(多模态生成方向)

杭州 ·经验不限·学历不限

杭州

职位描述

本岗位面向多模态生成模型的各训练阶段的高质量数据算法需求,聚焦于构建高效、高精准、细粒度的多模态数据pipeline: 1. 多模态数据体系构建:负责视频生成模型全阶段训练(预训练、SFT、后训练/RL)所需多模态数据对齐的算法建设,构建面向垂类场景的高质量、结构化的多模态对齐数据体系; 2. 数据筛选与合成算法:设计并落地从海量多模态数据中筛选/合成高价值数据的算法链路,包括音视频质量评估、美学打分、运动分析、时序切分、去重与分布均衡等。 3. 视频描述与对齐算法:构建高精度视频 Caption 体系(密集描述、结构化标签、时序事件描述),持续提升文本-视频对齐质量与粒度。 4. 数据-算法闭环:建立数据质量与模型效果的评估归因体系,结合业务需求推动""数据构建 → 模型训练 → 效果评估 → 数据迭代""的闭环持续优化。 【任职要求】 1. 计算机、人工智能、数学等相关专业硕士及以上学历,1 年以上多模态/生成模型相关经验; 2. 具备扎实的多模态理解与生成技术基础,熟悉主流视频生成模型架构(DiT、Diffusion/Flow Matching、VAE、CLIP/VLM 对齐等); 3. 具备高质量多模态数据构建能力,包括大规模数据清洗、增强、合成与标注体系设计,有 TB/PB 级视频数据处理流水线经验优先; 4. 熟练掌握多模态大模型相关的后训练技术(SFT、DPO、Flow-GRPO 等); 5. 具备从数据到算法闭环迭代的能力,能设计并实现多维度评测体系,结合自动指标与人工评估,定义数据质量标准并推动模型效果持续提升; 6. 扎实的工程能力,熟练掌握PyTorch开发、有Pytorch分布式训练经验; 7. 具备出色的分析问题和解决问题的能力,能够独立领导技术方向的探索和攻坚。对视觉艺术有良好的审美感知,能理解并拆解业务场景下的内容需求。 加分项 1. 在 CVPR/ICCV/NeurIPS/ICML 等顶会发表过多模态生成相关论文; 2. 主导或深度参与过知名AIGC项目者优先;"

最后确认在招:2026-09-01 19:06:52 · 来源平台:alibaba