小米 社会招聘
大模型算法专家
深圳 ·经验不限·学历不限
深圳
薪资面议
前往 小米 官网投递
职位描述
1. 面向Agentic OS,参与端侧大模型架构设计、预训练、后训练、端侧部署和推理加速;目标为通过算法与硬件和芯片的协同设计,在较低的功耗和内存预算下,实现模型效果和推理效率的平衡。
2. 负责LLM和VLM在端侧场景下的继续预训练(CPT)、后训练(SFT, OPD, RL等)及量化感知训练(QAT),构建从数据清洗处理到模型部署落地的全链路pipeline。
3. 针对端侧芯片和内存特性,设计新型模型结构,探索参数共享与稀疏化方案。
4. 负责模型压缩算法开发,如剪枝、量化、蒸馏等常用技术方案实现。 实施低比特量化(如INT4/INT8),在保证精度的前提下压缩模型体积与显存占用。
5. 负责推理加速算法实现,如投机解码、MTP等。
6. 建立端侧模型评测体系,不仅关注准确率,更关注首字延迟(Prefill)、生成速度(Decoding)、功耗峰值等硬性指标。
7. 前沿技术探索与成果产出,建立Agentic OS的算法创新壁垒,推动顶级会议论文与核心专利产出。
【任职要求】
1. 硕士及以上学历,人工智能、计算机科学、电子信息技术等相关专业;
2. 具备以下至少一到两个方向的深入研究或实践经验:大语言模型、多模态大模型、大模型后训练、大模型预训练、强化学习;
3. 深入掌握Transformer架构,了解主流dense和MoE开源模型(Qwen, Deepseek等)的结构设计原理;
4. 具备复杂系统建模能力,能够从系统角度设计完整闭环;
5. 在 ICML / NeurIPS / ICLR / AAAI / ACL / CVPR / EMNLP 等顶级会议发表论文者优先;
6. 具备较强的独立研究能力与创新能力。
官网发布:2026-08-03 · 最后确认在招:2026-09-03 23:18:29 · 来源平台:xiaomi