直招.cv

← 返回职位列表

字节跳动 社会招聘

AI大模型算法工程师(LLM/Agent/RL)-集团信息系统

上海 ·经验不限·学历不限

上海

职位描述

1、探索下一代Agent:研究Agent在复杂长程任务(Long-horizon Tasks)中的能力边界;探索Planning、Memory、Tool Use、Multi-Agent、Proactive Agent等方向;构建面向真实生产环境的大规模Agent系统; 2、大模型后训练(Post-training):基于SFT、Preference Learning、RL(GRPO、PPO等)持续提升模型能力;构建Agent Reward、自动评测体系和训练数据闭环;探索Long Context、Reasoning、Tool Calling等能力优化; 3、AI原生产品算法研发:将LLM技术应用于企业服务场景;探索用户理解、长期记忆、行为建模、个性化等方向;持续提升AI产品的智能化体验; 4、端侧模型与推理优化:探索VLM、LLM在移动端、端侧设备上的部署与优化;持续优化模型推理效率、延迟、成本和用户体验;研究模型压缩、量化、蒸馏等技术。 【任职要求】 1、扎实的机器学习、深度学习基础; 2、熟悉Transformer、Attention、MoE等主流模型结构; 3、理解LLM的训练流程,包括Pre-training、SFT、RLHF/Post-training; 4、熟悉Python,具备良好的工程能力和代码质量意识; 5、能快速阅读论文并复现最新工作。 加分项(有以下任一经验即可): 1、LLM后训练(SFT、DPO、RL、GRPO等); 2、Agent/Tool Use/MCP/Multi-Agent; 3、训练或推理系统(Megatron、DeepSpeed、vLLM、SGLang等); 4、端侧模型部署(MLX、MNN、TensorRT、ONNX、CoreML等); 5、参与过开源模型训练或发表相关论文。

官网发布:2026-08-10 · 最后确认在招:2026-09-03 19:35:21 · 来源平台:feishu