美团 校园招聘
【基座大模型北斗实习】大模型复杂推理前沿研究
北京 ·经验不限·学历不限
北京市·上海市
薪资面议
前往 美团 官网投递
职位描述
简介:Reasoning(推理)是大模型理解和处理信息的核心能力,是通用智能水平逼近的重要观测维度。本课题聚焦于探究生成式模型的高级推理发生机制,提升大模型在复杂任务上的推理表现。
研究内容包括但不限于:
1、复杂任务推理应用效果优化,诸如逻辑推理、数学推理、代码推理、跨模态推理、多模型决策等。
2、RL scaling,通过大规模强化学习持续提升模型推理能力。
3、Test time scaling,通过增加inference时消耗的算力持续提升模型推理能力。
【任职要求】
1、熟悉NLP、LLM、RL等相关领域,对其中一个或多个方向有深入的研究经历,且有相关实际项目经验;
2、熟悉Python、C++等至少一门编程语言,熟悉LINUX环境;
3、熟悉 Megatron、DeepSpeed 等开源训练框架;
4、熟悉PPO、DPO、GRPO等常用RL算法。
加分项:
1、有影响力的开源项目中做出过核心贡献;
2、发表过高水平论文优先(如NeurIPS,ICLR,ICML,ACL,EMNLP等)。
官网刷新:2026-04-03 · 最后确认在招:2026-09-03 19:50:14 · 来源平台:meituan