直招.cv

← 返回职位列表

智谱AI 社会招聘

AI院-AI Coding 评测工程师

北京 ·经验不限·学历不限

北京

职位描述

1. 深度体验并评测主流大模型在AI编程工具(如Claude Code、Roo Code、Cline、OpenCode等)中的实际表现,挖掘其优势与短板。 2. 参与构建和完善AI编程工具的评测体系与标准,确保评测过程科学、可复现、可迭代。 3. 定期输出深度评测报告,涵盖不同工具/模型的对比分析、缺陷清单、优化建议及潜在产品机会。 4. 设计并开发可复现、可扩展的自动化评测框架,支持多任务并行测试与结果对比分析。 5. 构建高质量的模型DEMO示例,辅助团队理解工具特性,推动模型优化与产品方向探索。 6. 基于评测结果,为模型优化提供数据支持与产品建议,并有机会参与孵化AI编程相关的新产品。 【任职要求】 1. 具备独立开发者背景,有从0到1构建并落地项目的经验,对技术产品的实现路径有深刻理解。 | 或者参加过完整的应用项目开发,能独立解决问题,负责重要业务板块的设计实现,能独立分析排查线上故障。2年以上Java/Golang应用开发经验。 2. 熟练掌握至少一门编程语言(如Python、TypeScript、Golang、Rust等),具备扎实的工程落地能力。 3. 拥有6个月以上AI编程工具(如Cursor、Copilot、Claude等)的深度使用经验,能够熟练运用AI辅助完成实际开发任务。 4. 具备较强的逻辑思维和数据分析能力,能够从复杂体验中提炼关键问题并推动解决。 5. 对AI技术及其应用有浓厚兴趣,具备良好的沟通能力和团队协作精神。 【加分项】 有AI辅助开发的开源项目经验,或独立开发过具备实际用户群体的产品。 | 或者组织过团队的代码评审。 在AI Coding领域有技术内容输出经历(如教程、测评文章、项目案例等)。 具备产品思维,能够从用户视角出发,结合技术实现提出可行的产品优化方向。 【特殊注明】 本工作不涉及开发,以评测为主。

官网发布:2025-10-21 · 最后确认在招:2026-09-03 19:37:57 · 来源平台:feishu