阶跃星辰 社会招聘
Mid-train 算法研究员/工程师
上海 ·经验不限·学历不限
上海·北京
薪资面议
前往 阶跃星辰 官网投递
职位描述
Pre-training让模型认识世界,Mid-training让模型获得改变世界的能力。
模型经过Pre-training后能够掌握大量知识,但真正决定模型是否具备复杂任务能力的,是从基础模型到智能模型之间的能力塑造过程。Mid-training正成为连接Foundation Model与Reasoning、Agent时代的重要阶段。
你将负责探索:
如何让模型在已有知识基础上持续获得代码、数学、Reasoning、Agent、多模态等高级能力;
如何避免持续训练过程中模型能力遗忘,实现稳定的能力增长;
如何设计有效的训练Recipe,让模型能力从Scaling走向Capability Emergence
如何利用课程学习、持续学习、自蒸馏、Synthetic Data等方法提升训练效率
如何建立从数据构造、训练实验到能力评估的完整能力增长闭环
这里的问题不是让模型学更多,而是让模型学会更复杂的事情。
岗位职责
负责大语言模型 Mid-training 阶段算法研究,探索模型能力持续增强的方法与训练范式。
围绕代码、数学、Reasoning、Long Context、Agent、多模态等方向设计训练方案,提升模型复杂任务解决能力。
研究 Curriculum Learning、Continual Learning、Self-training、Knowledge Injection 等训练方法,并通过大规模实验验证有效性。
分析模型能力变化规律,定位能力提升与退化原因,建立系统化的模型能力迭代方法。
与Pre-train、Post-train、Evaluation、Infra团队协作,打通从基础模型到高级能力模型的完整训练链路。
任职要求
从内心深处认可数据的价值
2026 届或 2027 届计算机、人工智能、数学、电子、自动化等相关专业硕士及以上或优秀本科生;
熟悉大语言模型训练流程,理解Transformer架构、预训练及后训练基本方法。
具备较强实验设计能力,能够独立完成训练实验、数据分析和模型能力评估。
对Reasoning、Code Model、Long Context、Agent、多模态训练等方向有深入理解或实践经验者优先。
在各类竞赛中取得突出成绩,或在开源社区有重要贡献者优先。
官网发布:2026-09-02 · 最后确认在招:2026-09-03 22:42:05 · 来源平台:moka