直招.cv

← 返回职位列表

蔚来 校园招聘

校招-多语言大模型算法工程师

北京 ·经验不限·学历不限

北京

职位描述

1. 智能体架构设计与实现:负责基于大语言模型(LLM)的自主智能体(Agent)核心架构设计,包括感知、规划、记忆、工具调用与动作执行等模块。 2. 推理与规划算法优化:研发并改进智能体的推理策略(如 CoT、ToT、ReAct、Reflexion 等),提升复杂任务拆解、多步规划与动态纠错能力。 3. 环境交互与工具学习:设计 Agent 与环境(模拟环境、API、知识库、操作系统等)的高效交互机制,实现工具自主调用与多模态信息整合。 4. 记忆与长期学习机制:开发基于向量数据库、知识图谱或结构化记忆的长期记忆模块,支持上下文压缩、经验回放与持续学习。 5. 多智能体协作:研究多智能体系统的通信协议、任务分配、共识机制与协作策略,构建可扩展的多智能体仿真或应用系统。 6.评估与安全可控性: 建立智能体在开放任务下的效果评估体系(成功率、效率、鲁棒性、安全性等),并对抗潜在的有害行为或目标偏离问题。 7.工程落地与部署: 与后端/平台团队协作,将智能体算法集成到产品中(如 AI 助手、自动化工作流、游戏 NPC、机器人控制等),优化推理延迟与成本。 【任职要求】 1. 基本条件 计算机、人工智能、数学、自动化等相关专业硕士及以上学历,博士优先。 2. 技术能力 扎实的编程功底:精通 Python,熟悉 PyTorch / TensorFlow / JAX 至少一种深度学习框架。 LLM 与 Prompt 工程:深入理解 Transformer 架构,熟悉主流 LLM(GPT、Claude、Llama、Qwen 等)的 API 及本地部署,有丰富的 prompt tuning、few-shot 及 chain-of-thought 实战经验。 3. 智能体框架:使用过 LangChain、AutoGen、BabyAGI、CAMEL 等至少一种 Agent 框架,并能进行底层逻辑定制。 4. 强化学习(加分核心项):熟悉 MDP、策略梯度、PPO、DQN 等基础 RL 算法,有 RLHF 或 RLAIF 实践经验者优先。 5. 工程能力:熟悉 Docker、Kubernetes、RESTful API 开发;具备分布式计算、推理加速(vLLM、TensorRT)经验者优先。 6. 软素质 较强的逻辑分析与问题拆解能力,能独立完成从论文复现到产品落地的全流程。 对智能体的安全、对齐、可解释性问题有认知,具备技术风险评估意识。 良好的团队沟通能力与英文文献阅读能力。 7. 加分项:在顶会(NeurIPS、ICML、ICLR、ACL、EMNLP、CoRL 等)上发表过智能体、RL、LLM reasoning 相关论文。 拥有大规模多智能体系统(如模拟社会、游戏 AI、自动化运维)的实际项目经验。 熟悉传统符号规划(PDDL)、图神经网络或元学习。 对开源智能体社区有持续贡献(如提交过 LangChain、AutoGPT、XAgent 等项目的核心 PR)。

官网发布:2026-08-12 · 最后确认在招:2026-09-03 19:28:25 · 来源平台:feishu