小鹏汽车 校园招聘
【27届校招】机器人RLHF强化学习算法工程师
深圳 ·经验不限·学历不限
深圳·北京
薪资面议
前往 小鹏汽车 官网投递
职位描述
我们致力于推动强化学习(Reinforcement Learning, RL)在人形机器人运动控制、大语言模型推理优化、和具身智能体(Embodied AI) 领域的突破性应用。现招募具备深厚RL技术背景的算法工程师,参与从算法设计、仿真训练到真实场景部署的全链路研发,探索AI与物理世界的深度融合。
1、研究大语言模型RLHF阶段的广义强化算法,提升大模型的能力,探索大模型的自我进化之路;
2、研究大模型驱动的智能体算法,包括但是不局限于ReACT、Voyager、WebGPT、AutoGPT;
3、撰写技术报告和论文,分享研究成果,参与内外部的技术交流和合作,推动团队技术水平的提升,提高团队在行业内的影响力。
【任职要求】
1、具备扎实的机器学习基础和强悍的编码能力,能熟练使用 PyTorch;
2、在大模型训练和强化学习至少一个方向上有经验;
3、对人工智能和大模型技术有强烈的兴趣和热情,愿意不断学习和探索新技术。
【加分项】
1、有 ICML、ICLR、NeurIPS、ACL、CVPR 等顶级学术会议发表过有影响力研究成果的优先;
2、在 ACM/ICPC、NOI/IOI、Kaggle 等编程/AI 比赛获奖者优先;
3、主导、参与过 AI 相关的有大影响力的开源/闭源项目的优先。
官网发布:2026-07-24 · 最后确认在招:2026-09-03 19:27:27 · 来源平台:feishu