Token Foundry · 校园招聘
算法工程师-数据算法(多模态生成方向)
杭州 ·经验不限·学历不限
杭州
职位描述
本岗位面向多模态生成模型的各训练阶段的高质量数据算法需求,聚焦于构建高效、高精准、细粒度的多模态数据pipeline:
1. 多模态数据体系构建:负责视频生成模型全阶段训练(预训练、SFT、后训练/RL)所需多模态数据对齐的算法建设,构建面向垂类场景的高质量、结构化的多模态对齐数据体系;
2. 数据筛选与合成算法:设计并落地从海量多模态数据中筛选/合成高价值数据的算法链路,包括音视频质量评估、美学打分、运动分析、时序切分、去重与分布均衡等。
3. 视频描述与对齐算法:构建高精度视频 Caption 体系(密集描述、结构化标签、时序事件描述),持续提升文本-视频对齐质量与粒度。
4. 数据-算法闭环:建立数据质量与模型效果的评估归因体系,结合业务需求推动""数据构建 → 模型训练 → 效果评估 → 数据迭代""的闭环持续优化。
【任职要求】
1. 计算机、人工智能、数学等相关专业硕士及以上学历,1 年以上多模态/生成模型相关经验;
2. 具备扎实的多模态理解与生成技术基础,熟悉主流视频生成模型架构(DiT、Diffusion/Flow Matching、VAE、CLIP/VLM 对齐等);
3. 具备高质量多模态数据构建能力,包括大规模数据清洗、增强、合成与标注体系设计,有 TB/PB 级视频数据处理流水线经验优先;
4. 熟练掌握多模态大模型相关的后训练技术(SFT、DPO、Flow-GRPO 等);
5. 具备从数据到算法闭环迭代的能力,能设计并实现多维度评测体系,结合自动指标与人工评估,定义数据质量标准并推动模型效果持续提升;
6. 扎实的工程能力,熟练掌握PyTorch开发、有Pytorch分布式训练经验;
7. 具备出色的分析问题和解决问题的能力,能够独立领导技术方向的探索和攻坚。对视觉艺术有良好的审美感知,能理解并拆解业务场景下的内容需求。
加分项
1. 在 CVPR/ICCV/NeurIPS/ICML 等顶会发表过多模态生成相关论文;
2. 主导或深度参与过知名AIGC项目者优先;"
最后确认在招:2026-09-01 19:06:52 · 来源平台:alibaba