岗位职责
- 深度参与建设微信 Agent 业务,设计并开发微信 Agent 相关的评测工具和自动化评测流水线,支持对话质量、任务完成率、安全性等多维度评测;
- 参与构建基于 LLM 的自动评测模型,实现对 Agent 输出质量的自动化打分与分析;
- 参与评测平台的架构设计与开发,支持评测任务管理、数据管理、结果可视化等功能;
- 参与构建评测数据集,开发数据清洗、标注管理、统计分析等配套工具;
- 跟踪业界前沿评测方法,持续优化评测效率和准确性。
职位要求
- 本科及以上学历,计算机科学、人工智能、软件工程等相关专业,3 年以上开发经验;
- 熟悉 Python/Nextjs,熟悉至少一门后端语言(Go/Java/C++),熟悉 Linux 环境及常用中间件(MySQL/Redis/消息队列等);
- 热衷于 AI 技术,具备极强的 AI Coding 能力;
- 具备 AI Agent / LLM 应用的评测或开发经验,熟悉主流 LLM 的 API 调用与 Prompt Engineering;
- 了解常见评测方法论(自动评测、人工评测、A/B Test、LLM-as-a-Judge 等),有评测模型训练经验者优先;
- 具备良好的系统设计能力,有平台类产品或工具链开发经验;
- 有多模态模型或 ASR/TTS 系统评测经验者优先,熟悉 WER、MOS 等指标;
- 熟悉开源评测框架者优先;
- 良好的沟通协作能力,能与产品经理、算法工程师高效配合。