阶跃星辰 社会招聘
大语言模型post-train算法研究员
北京 ·经验不限·学历不限
北京
薪资面议
前往 阶跃星辰 官网投递
职位描述
【岗位描述】
1、参与通用推理大模型对齐(Alignment)方向的研发工作,涵盖数据循环体系的构建,以及在监督微调(SFT)与强化学习(RL)阶段中对数据使用策略的系统性探究。
2、深入探索对齐阶段(Alignment)的数据与算法在大规模训练中的可扩展性与优化路径。
3、参与构建世界领先的高性能通用推理大模型,在多项客观评测指标中保持行业领先。
【任职要求】
1、国内外计算机、数学、人工智能等相关专业的博士或优秀研究生。
2、对数据有一定的敏感度,熟知开源社区各数据渠道源,有数据处理的经验和认知。
2、对大模型相关研究前沿进展比较熟悉,如Reasoning RL、Agent RL等,具有大模型研发经验者优先。
3、有一定的相关研究经历,发表过顶级会议论文者优先,如ICLR,NeurIPS,ICML等。
4、具备扎实的编程基础,有优秀的工程能力,具有NOI、ACM/ICPC等编程竞赛金牌获奖者优先。
5、具备良好的团队协作能力和沟通能力。
官网发布:2026-05-27 · 最后确认在招:2026-09-03 22:42:05 · 来源平台:moka