字节跳动 社会招聘
AI大模型算法工程师(LLM/Agent/RL)-集团信息系统
上海 ·经验不限·学历不限
上海
薪资面议
前往 字节跳动 官网投递
职位描述
1、探索下一代Agent:研究Agent在复杂长程任务(Long-horizon Tasks)中的能力边界;探索Planning、Memory、Tool Use、Multi-Agent、Proactive Agent等方向;构建面向真实生产环境的大规模Agent系统;
2、大模型后训练(Post-training):基于SFT、Preference Learning、RL(GRPO、PPO等)持续提升模型能力;构建Agent Reward、自动评测体系和训练数据闭环;探索Long Context、Reasoning、Tool Calling等能力优化;
3、AI原生产品算法研发:将LLM技术应用于企业服务场景;探索用户理解、长期记忆、行为建模、个性化等方向;持续提升AI产品的智能化体验;
4、端侧模型与推理优化:探索VLM、LLM在移动端、端侧设备上的部署与优化;持续优化模型推理效率、延迟、成本和用户体验;研究模型压缩、量化、蒸馏等技术。
【任职要求】
1、扎实的机器学习、深度学习基础;
2、熟悉Transformer、Attention、MoE等主流模型结构;
3、理解LLM的训练流程,包括Pre-training、SFT、RLHF/Post-training;
4、熟悉Python,具备良好的工程能力和代码质量意识;
5、能快速阅读论文并复现最新工作。
加分项(有以下任一经验即可):
1、LLM后训练(SFT、DPO、RL、GRPO等);
2、Agent/Tool Use/MCP/Multi-Agent;
3、训练或推理系统(Megatron、DeepSpeed、vLLM、SGLang等);
4、端侧模型部署(MLX、MNN、TensorRT、ONNX、CoreML等);
5、参与过开源模型训练或发表相关论文。
官网发布:2026-08-10 · 最后确认在招:2026-09-03 19:35:21 · 来源平台:feishu