阶跃星辰 社会招聘
大模型强化学习算法研究员
北京 ·经验不限·学历不限
北京
薪资面议
前往 阶跃星辰 官网投递
职位描述
岗位职责
1、研究语言及多模态大模型RLHF阶段的广义强化算法,提升大模型的能力,探索大模型的自我进化之路。
2、研究大模型驱动的智能体算法,包括但是不局限于ReACT, Voyager, WebGPT, AutoGPT。
任职要求
1、985/211学历,计算机科学、人工智能、自动化、数学等专业。
2、具备扎实的机器学习基础和强悍的编码能力,能熟练使用 PyTorch。
3、在大模型训练和强化学习至少一个方向上有在学术工业界高影响力的工作。
4、对人工智能和大模型技术有强烈的兴趣和热情,愿意不断学习和探索新技术。
加分项
1、有 ICML、ICLR、NeurIPS、ACL、CVPR 等顶级学术会议发表过有影响力研究成果的优先。
2、在 ACM/ICPC、NOI/IOI、Kaggle 等编程/AI 比赛获奖者优先。
3、主导、参与过 AI 相关的有大影响力的开源/闭源项目的优先。
官网发布:2026-07-23 · 最后确认在招:2026-09-03 22:42:05 · 来源平台:moka