岗位职责
- 负责AI Agent评测体系、指标体系及质量标准的设计与持续优化;
- 搭建可扩展的评测流程,覆盖人工评测、模型评测,以及线上与线下验证机制;
- 构建并维护面向广告Agent核心场景的Benchmark数据集;
- 与AI研发及工程团队协作,推动评估模型和评测方法的持续迭代;
- 建设评测工具平台,支持实验追踪、回归测试、数据标注、错误分析与结果汇报;
- 通过评测结果沉淀洞察,持续驱动广告Agent产品质量提升。
职位要求
- 具备3-5年产品相关经验,包括AI、评测、广告或营销技术领域;
- 对LLM、AI Agent以及评测方法论有较好的理解;
- 熟悉Benchmark、数据集、Rubrics制定以及标注相关流程;
- 好奇心强,对AI和营销的结合有热情;
- 具备优秀的跨团队协作与沟通能力。