直招.cv

← 返回职位列表

阶跃星辰 校园招聘

基模post-train算法实习生

北京 ·经验不限·学历不限

北京

职位描述

实习期间可以参与以下内容: Agent智能能力构建:参与大模型 Post-training 阶段的算法研究与实践,围绕 SFT、RL、Self-Improvement 等方法,系统性提升模型的推理、泛化与对齐能力,探索高效构建通用智能模型的训练范式。 下一代学习机制预研:开展前沿算法研究,包括但不限于在线学习(Online Learning)、持续学习(Continual Learning)、自适应数据采样与模型自我进化机制,推动模型在长时间尺度下的稳定学习与能力积累。 Scalable RL 算法与系统基建:参与可扩展强化学习(Scalable RL)相关算法与训练框架的设计与实现,支持大规模并行训练、长上下文与高效 rollout,提升 RL 在大模型场景下的稳定性与效率。 实验与评测:设计并实施系统化实验,分析模型在复杂推理、泛化任务与真实场景中的表现,推动算法从研究原型走向可复现、可扩展的训练流程。 我们希望你具备 国内外高校研究生在读,人工智能、计算机、自动化、数学相关专业优先; 优秀的代码能力、数据结构和基础算法功底,熟练掌握Python; 出色的问题分析和解决能力,能深入解决大模型训练和应用存在的问题,有自主探索解决方案的能力; 有责任心和良好的沟通协作能力,能和团队一起探索新技术,推进技术进步; 扎实的机器学习基础,熟悉NLP、RL领域的技术,在NeurIPS/ICML/ICLR等顶级会议上发表论文者优先; 实习时长: 能够长期实习(6个月及以上优先),每周出勤不少于4天。 我们的优势: 顶尖GPU集群算力支持,快速迭代实验有影响力idea 实习期间表现优秀者,可直接获得转正名额

官网发布:2026-01-13 · 最后确认在招:2026-09-03 20:15:56 · 来源平台:moka