Token Foundry · 校园招聘
算法工程师-Agent算法研究
杭州 ·经验不限·学历不限
北京·杭州·上海
职位描述
1. 围绕大模型 Agent 系统开展算法研究与工程落地,推动模型在真实世界复杂任务中的能力演进。方向涵盖 Cowork Agent(面向金融、法律、医疗、设计、数据分析、工业等行业高价值场景)与 Computer Use Agent(面向 Computer / Mobile / Browser 等跨平台人机交互场景),使模型能够理解、操作并协同完成开放环境中的复杂用户任务。
2. Envs / Harness Building & Generalization:复现并维护高可靠性主流 Harness 环境,设计 CLI & GUI 统一范式下的 Universal Digital Agent Harness 与 Behavior Pattern;探索 Loop Engineering、Multi-Agent 与 Auto-Harness,提升模型在不同场景下的泛化能力、鲁棒性与实际可用性。
3. Data Design & Scaling:挖掘行业高价值数据与 workflow,探索大规模自然轨迹 Pre-training、数据 Pattern 演化与 User-Centric Data 优化,构建 General Long-Horizon Data Pipeline;在 CPT/SFT/RL 端到端验证配比与学习策略,优化模型端到端长程的行业 Agent 解决方案。
4. Agentic Rewarding & Feedback Modeling:构建面向真实 Agentic 任务的 General Verifier,设计 Evolving Rubrics 与 Code Verifier,实现 Outcome & Process Level 数据监督与自动化 Rewarding;探索用户偏好与反馈的收集、建模与处理机制,研究显式反馈与隐式反馈的统一表征,建立可用于训练和评估的反馈闭环。
5. Real World RL:基于真实环境与真实任务的大规模 Agentic RL 训练,探索 CPT→RL 的端到端 Scaling Law、Multi-step Reward Shaping 与 Agentic Behavior Learning,持续提升 Agent 在开放环境中的长期规划、任务分解、多步执行与自主优化能力。
6. 跟踪相关领域前沿进展,围绕关键问题开展算法创新、实验验证与系统落地,沉淀可复用的方法与能力。
【任职要求】
1. 2027届毕业生,计算机、人工智能、机器学习、深度学习、软件工程或相关专业本科及以上学历。
2. 具备扎实的机器学习与深度学习基础,在大语言模型或多模态大模型领域有理论认知或实践经验,熟悉模型训练、对齐、微调或推理优化相关技术。
3. 满足以下条件之一者优先:
(1)有 Agent 系统、强化学习、RLHF、数据合成或自动化训练 Pipeline 相关项目或研究经验;有 GUI Agent、Computer Use、人机交互或 Universal Digital Agent 方向的研究或工程经验;在大规模模型训练、优化算法、生成式模型、自监督学习等至少一个领域有创新性成果,或主导/深度参与过有行业影响力的项目。
(2)极强的求知欲与学习能力,对新技术保有好奇心;逻辑清晰,善于独立思考,具备良好的沟通与跨团队协作能力。
(3)熟悉 Python 与主流深度学习框架,具备较强的工程实现能力,能够高效实现复杂模型结构并进行大规模训练;有高水平论文、开源项目、竞赛成绩(ACM/ICPC、TopCoder 等)或实际落地成果者优先。
最后确认在招:2026-09-01 19:06:52 · 来源平台:alibaba