直招.cv

← 返回职位列表

小米 社会招聘

服务端资深工程专家

武汉 ·经验不限·学历不限

武汉

职位描述

作为一名高级服务端研发工程师,您将会是小爱同学研发团队的关键一员,主要责任包括: 1. 主导 Agent Benchmark 的平台化落地:负责 SWE、Terminal、Claw、MCP 等多类 Agent Benchmark 在评测平台上的整体接入与工程化,沉淀标准化、可复用的接入能力,避免每类 Benchmark 重复建设; 2. 构建评测运行底座:统筹沙盒环境、依赖管理、网络访问、并发调度等关键能力建设,保障大规模评测在生产环境下的稳定、可复现与高效运行; 3. 保障评测质量与可观测性:从 Harness 与打分逻辑出发,确保平台化改造后评测结果的准确可信,并建立完善的诊断与问题归因能力; 4. 衔接算法与工程:深入理解各 Benchmark 所考察的模型能力维度,作为算法团队与工程平台之间的技术桥梁,推动评测需求高质量落地; 5. 沉淀工程标准:推动评测任务、指标产物、结果归档、版本追溯等标准化规范,支撑评测能力被算法、产品、技术方向团队持续复用。 【任职要求】 任职要求 - 计算机相关专业本科及以上学历,5年及以上后端/平台/Infra 研发经验; - 精通至少一门主流后端语言(Python/Go/Java 等); - 主导过中大型平台或系统的设计与落地,具备优秀的系统设计与工程实现能力; - 熟悉容器化与沙盒隔离、分布式系统、任务调度与并发控制,有大规模任务编排或性能优化经验;熟悉网络通信与代理机制,能处理外部接口访问与稳定性问题; - 了解大模型与 Agent 的基本原理,熟悉主流 Agent Benchmark(如 SWE-bench、Terminal-Bench、MCP 相关评测等)的 Harness 与打分逻辑,并据此进行工程化抽象,能与算法团队就模型能力与评测指标深度对话。 加分项 - 有搭建评测/实验平台或类似系统类基础设施从0到1的经验; - 有多终端/沙箱环境(虚拟设备、仿真环境)架构设计经验; - 主导过平台或新老系统整体演进、迁移的经验; - 对评测方法论(LLM-as-judge 等)有一定理解。

官网发布:2026-08-30 · 最后确认在招:2026-09-03 23:18:29 · 来源平台:xiaomi