岗位职责
- 深度参与企业AI产品从想法到落地的全过程;
- 洞察企业用户真实需求:通过用户访谈、数据分析和行为洞察,抽象出企业用户的痛点,并推动其在产品中落地;
- 负责测评产品规划与体系设计:围绕AI Agent的工作场景,设计评测框架、评测流程与产品机制,把前沿能力沉淀为可复用、可持续迭代的测评体系;
- 推动评测工程化与跨团队协同:与算法、工程、数据团队紧密协作,推动评测平台、自动化流水线与结果看板建设,让评测真正服务模型优化与产品决策。
职位要求
- 本科及以上学历,具备扎实的结构化思考能力,对测评、数据与AI产品交叉方向有持续积累;
- 逻辑清晰、自我驱动、以用户价值为先,能站在用户视角思考并解决问题,具备良好的沟通与跨团队协作能力;
- 对AI产品方向、模型评测与Benchmark体系有浓厚兴趣,持续关注LLM/Agent领域前沿动态;
- 熟悉Claude Code、Cursor、扣子等AI/Agent工具,理解评测自动化、数据处理或实验流水线;
- 有第三方评测体系(如SWE-Bench)使用、分析或相关项目经验者优先;
- 有搭建Agent、评测平台或AI应用的实践经验。