直招.cv

← 返回职位列表

夸克 · 社会招聘

千问事业部-大模型Agent算法专家(生态合作与智能协议)-杭州/北京

杭州 ·2年以上·硕士

北京·杭州

职位描述

我们正在重新定义“千问”:从一个博学的对话者进化为具备执行力的数字实体。我们的核心使命是构建一套统一的认知架构,打破模型与现实世界的壁垒。通过 Skill-based Agent 技术,实现从“语义理解”到“任务闭环”的跨越,让 AI 真正深入生产力场景,实现数字世界与物理世界的高效连接 1. 统一认知架构设计与能力演进: - 深度对接阿里集团内部及外部第三方服务,设计并实现高效、稳定的 Agent 框架。负责将复杂的业务逻辑抽象为可插拔的配置、标准化的工具,供大模型理解与调用。 - 设计 skill-based 【统一Agent】架构,实现长程规划与自我反思能力的统一认知架构,以协调内部的推理、记忆和执行模块,实现统一智能体在跨场景、长链条任务上的优异表现。 - 推动并构建一个动态的“千问能办” skill library,将海量、异构的原子能力抽象为该统一智能体可学习、可组合、可泛化的skill,探索自动化技能发现与组合优化的前沿方法。 2. 核心场景算法优化: ⁃长程规划与决策优化: 针对复杂复合需求,研发先进的任务分解与多步推理算法,解决长链条执行中的错误积累与漂移问题。 -Agentic-RL 策略: 构建基于 环境反馈的强化学习(RLHB/RLAIF) 体系,通过在模拟环境中的大规模探索,提升 Agent 在极端场景下的鲁棒性与决策上限。 -领域知识注入: 针对高频场景(学习、办公、生活)进行长程预训练与持续学习,让 Agent 不仅拥有通用逻辑,更具备深度的行业专家意识。 3. 实际需求驱动迭代: - 建立科学、全面的Agent评测体系,通过线上数据分析、Bad Case挖掘,精准定位模型在幻觉、误拒答、组合泛化、执行失败等方面的瓶颈。 - 领导数据驱动的迭代飞轮,不仅是利用线上反馈进行微调,更要探索世界模型模拟、合成数据生成、以及基于AI反馈的强化学习等手段,高效、规模化地提升统一智能体的能力上限。 【任职要求】 1、深厚的大模型研发经验:熟悉主流大模型(如Qwen、GLM系列)的原理、微调技术及分布式训练框架,精通 Agent/RAG 架构,有从零构建 Skill-based 系统或大型 Multi-Agent 协作系统的落地经验。 2、综合素质:具备优秀的逻辑思维与沟通协调能力,有强烈的主人翁意识,能适应快节奏的业务迭代。 3、加分项:在顶级会议(NeurIPS/ICML/CVPR/ACL等)发表过论文者优先;熟悉Agentic RL的方法优先;

最后确认在招:2026-09-01 19:07:02 · 来源平台:alibaba