直招.cv

← 返回职位列表

通义实验室 · 社会招聘

Token Foundry-模型自进化算法专家-Qwen模型训练

杭州 ·1年以上·学历不限

北京·杭州

职位描述

1. 围绕模型自进化方向开展算法研究与系统研发,探索大模型能力自动演进的关键路径。 2. 聚焦Agent任务,为模型注入自动迭代RL/SFT训练数据的能力,包括Agent环境/query/verifier合成、筛选、训练、反馈闭环优化,通过多轮迭代提升训练数据质量。 3. 为模型注入自动挖掘CPT/PT训练数据的能力,提升预训练和持续训练数据的知识覆盖度、有效性与任务适配性。 4. 为模型注入自动化训练与自动化Infra调优能力,包括Verl、Megatron等框架的训练策略优化、RL超参搜索、训练稳定性提升、SGLang、vLLM推理效率优化等,提升模型研发效率和性能上限。 5. 研究基于self-evolving、long-horizon等范式的能力增强方法,提升模型在自迭代任务中的长期规划、任务分解、多步执行与自主反馈优化能力。 6. 跟踪相关领域前沿进展,结合实际问题开展算法创新、实验验证和系统落地,沉淀可复用的方法与能力。 【任职要求】 1. 计算机、人工智能、自动化等相关专业本科及以上学历,硕士/博士优先。 2. 具备扎实的机器学习、深度学习基础,熟悉大模型训练、对齐、微调或推理优化相关技术。 3. 实现过有效的自动化数据构造Pipeline优先。 4. 实现过自动化训练、超参数优化、训练系统或推理框架优化优先。 5. 极强的求知欲与学习能力,对新技术保有好奇心;逻辑清晰,善于独立思考并反思总结;具备良好的沟通能力和团队协同意识。 6. 熟悉Python;具备较强的工程实现能力。 7. 具备较强科研能力或技术产出能力,有高水平论文、开源项目、竞赛成绩或实际落地成果者优先。

最后确认在招:2026-09-01 19:09:38 · 来源平台:alibaba