直招.cv

← 返回职位列表

阶跃星辰 社会招聘

Mid-train 算法研究员/工程师

上海 ·经验不限·学历不限

上海·北京

职位描述

Pre-training让模型认识世界,Mid-training让模型获得改变世界的能力。 模型经过Pre-training后能够掌握大量知识,但真正决定模型是否具备复杂任务能力的,是从基础模型到智能模型之间的能力塑造过程。Mid-training正成为连接Foundation Model与Reasoning、Agent时代的重要阶段。 你将负责探索: 如何让模型在已有知识基础上持续获得代码、数学、Reasoning、Agent、多模态等高级能力; 如何避免持续训练过程中模型能力遗忘,实现稳定的能力增长; 如何设计有效的训练Recipe,让模型能力从Scaling走向Capability Emergence 如何利用课程学习、持续学习、自蒸馏、Synthetic Data等方法提升训练效率 如何建立从数据构造、训练实验到能力评估的完整能力增长闭环 这里的问题不是让模型学更多,而是让模型学会更复杂的事情。 岗位职责 负责大语言模型 Mid-training 阶段算法研究,探索模型能力持续增强的方法与训练范式。 围绕代码、数学、Reasoning、Long Context、Agent、多模态等方向设计训练方案,提升模型复杂任务解决能力。 研究 Curriculum Learning、Continual Learning、Self-training、Knowledge Injection 等训练方法,并通过大规模实验验证有效性。 分析模型能力变化规律,定位能力提升与退化原因,建立系统化的模型能力迭代方法。 与Pre-train、Post-train、Evaluation、Infra团队协作,打通从基础模型到高级能力模型的完整训练链路。 任职要求 从内心深处认可数据的价值 2026 届或 2027 届计算机、人工智能、数学、电子、自动化等相关专业硕士及以上或优秀本科生; 熟悉大语言模型训练流程,理解Transformer架构、预训练及后训练基本方法。 具备较强实验设计能力,能够独立完成训练实验、数据分析和模型能力评估。 对Reasoning、Code Model、Long Context、Agent、多模态训练等方向有深入理解或实践经验者优先。 在各类竞赛中取得突出成绩,或在开源社区有重要贡献者优先。

官网发布:2026-09-02 · 最后确认在招:2026-09-03 22:42:05 · 来源平台:moka