直招.cv

← 返回职位列表

北方华创 社会招聘

大模型运维工程师

北京 ·经验不限·学历不限

北京市

职位描述

1.负责大模型训练、推理算力集群的部署、调度、运维与优化,建设统一AI基础设施平台。负责LLM、Embedding、多模态模型的容器化部署、服务化发布、推理加速及弹性扩缩容。负责GPU资源管理与调度优化,提升算力利用率,优化显存管理、任务排队、资源隔离等能力; 2.负责向量数据库及RAG检索架构建设,优化向量检索、索引、分片、存储及高并发查询性能; 3.负责前端Web平台、后端业务服务及AI应用平台的部署、发布、运维、升级和故障处理。负责CI/CD流水线建设,支持自动化部署、灰度发布、滚动升级、版本回滚及多环境管理。负责数据库、缓存、消息队列、对象存储、网关、Nginx等基础组件的部署、监控、备份和优化; 4.建设AI集群、GPU显存、模型推理链路、前后端服务、接口调用及中间件的监控告警体系。排查并解决服务卡顿、推理延迟、显存泄漏、接口异常、资源异常、服务不可用等问题。负责国产算力芯片、国产AI框架及相关生态的适配、部署与调优,推动国产化大模型落地。 【任职要求】 1.本科及以上学历,计算机、软件工程、人工智能等相关专业优先。 2.熟练掌握Docker、Kubernetes,具备前后端服务及模型服务的容器化部署和运维能力。熟悉Nginx、负载均衡、反向代理、HTTPS证书、域名解析、网关配置等平台运维工作。熟悉Jenkins、GitLabCI、ArgoCD等CI/CD工具,具备自动化发布、灰度发布、版本回滚经验者优先。 3.熟悉vLLM、llama.cpp、SGLang、XInference等推理框架,了解推理加速、量化、显存优化、并发优化等技术。熟悉Milvus、Qdrant等向量数据库,了解索引优化、分片、高可用部署及性能调优。 4.熟悉Prometheus、Grafana、ELK/EFK、Loki等监控和日志系统者优先。熟悉MySQL、PostgreSQL、Redis、MinIO、Kafka、Elasticsearch等常见中间件者优先。 5.具备较强学习能力、责任心和工程落地能力;无硬性年限要求,愿意长期深耕AI基础设施、算力平台及平台运维方向。

官网发布:2026-06-22 · 最后确认在招:2026-09-03 19:17:11 · 来源平台:beisen