字节跳动 社会招聘
推理GPU性能优化专家-Seed
北京 ·经验不限·学历不限
北京
薪资面议
前往 字节跳动 官网投递
职位描述
团队介绍:字节跳动Seed团队成立于2023年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。
Seed团队在AI领域拥有长期愿景与决心,团队研究方向涵盖MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE等超过50个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包App用户量在中国市场排名第一,豆包大模型日均Token调用量行业领先。
1、负责开发和优化字节跳动公司级的大模型推理框架;
2、主要通过GPU、CUDA性能优化的手段,结合线上实际情况,打造业界领先的高性能LLM推理引擎;
3、负责机器学习系统前瞻技术的调研和引入;
4、与算法部门深度合作,进行算法与系统的联合优化。
【任职要求】
1、本科及以上学历,计算机/电子/自动化/软件等相关专业,有AI工程优化经验的优先;
2、精通C/C++,精通算法与数据结构,熟悉Python;
3、熟练GPU的高性能计算优化技术,深入理解计算机体系结构,熟悉并行计算优化、访存优化,低比特计算等;
4、具备丰富的基于CUDA的GPU性能优化经验;
5、了解深度学习算法基本原理,熟悉神经网络基本架构和各算子计算方式,了解至少一种深度学习训练框架及其模型文件的解析,如PyTorch、TensorFlow;
6、熟悉TensorRT-LLM、ORCA、vLLM等,了解主流LLM模型,有LLM模型加速优化经验者优先。
官网发布:2024-05-08 · 最后确认在招:2026-09-03 19:35:21 · 来源平台:feishu