直招.cv

← 返回职位列表

小红书 · 社会招聘

大模型 Infra 产品运营

北京市,上海市,杭州市,深圳 ·经验不限·学历不限

北京市,上海市,杭州市,深圳市

职位描述

1. 效能指标体系搭建:协同算法、工程、基础设施团队,定义训练 & 推理效能核心指标(如 ETTR、MFU、GPU 利用率、吞吐、延迟等),建立统一的效能度量标准与口径; 2. 效能数据分析与诊断:基于平台运行数据,追踪效能指标变化趋势,识别瓶颈与异常,输出效能诊断报告,定位根因并推动优化; 3. 跨团队协同与推动:作为治理方向 Owner,拉通训练框架组、推理框架组、算力调度组、token 服务组等上下游团队,推动效能优化方案落地,跟踪优化效果并闭环; 4. 效能治理机制建设:建立效能问题发现、评估、排期、验收的标准流程,推动效能治理常态化、制度化。 5. 资源配额产品化:将 Quota 管理、潮汐调度、故障机自动化处理等底层能力产品化,设计清晰的配额分配策略与可视化看板,让资源管理对用户透明、可控、易用; 6. 资源利用率优化:监控 GPU 集群利用率、空置率、碎片化等指标,推动在离线混部、弹性调度等策略落地,提升整体资源效率。 7. 用户分层运营:建立平台用户分层运营策略,组织周期性 NPS 调研,持续追踪用户痛点并驱动产品改进;跟进重点业务用户回访,沉淀 Best Practice 案例; 8. 内容与影响力运营:联动引擎、业务、产研团队,构建内外部运营渠道并持续输出大模型平台技术内容,推动平台内外部影响力建设; 9. 数据运营:建立平台运营数据看板,追踪渗透率、DAU、功能使用深度等核心指标,定期输出运营分析报告,驱动策略迭代。 【任职要求】 任职要求 1. 学历与经验:硕士及以上学历,计算机或相关专业优先,3 年以上产品经理或平台运营经验,有技术 PM / 开发者工具产品经验者优先; 2. 大模型平台认知:理解大模型训练 / 推理 / 部署的基本流程,熟悉 LLM、MaaS、Agent 等核心概念,能与研发 / 算法同学无障碍沟通; 3. 效能治理经验:有 GPU 利用率、训练吞吐、推理延迟等效能指标定义与追踪经验者优先;理解 MFU、ETTR、Roofline 等核心概念; 4. 数据驱动能力:具备数据敏感度,能从平台使用数据和效能数据中发现问题、提炼洞察,并将数据结论转化为优化策略; 5. 推动力与跨团队协作:善于在高技术密度团队中推动复杂事项落地,能平衡多方诉求;具备 Owner 意识,能拉通上下游团队达成目标; 6. 产品设计能力:具备扎实的需求分析与功能设计能力,能将复杂技术需求转化为清晰可落地的产品方案。 加分项 1. 有 AI 平台、LLMOps、MLOps 或开发者工具完整产品交付经验; 2. 有 GPU 资源管理、云平台配额或弹性调度相关产品认知; 3. 对 AI Agent、工具调用、Prompt 工程、多 Agent 协作有基本认知; 4. 熟练使用 Claude Code、Cursor 等 AI 编程 / 生产工具,本身是 AI Native 工作方式的实践者; 5. 有 ToB 平台用户运营体系从 0 到 1 搭建经验,或有开发者社区运营经验。

最后确认在招:2026-09-01 19:11:29 · 来源平台:xiaohongshu