岗位职责
- 负责腾讯WorkBuddy/CodeBuddy/Miora等智能体产品质量保障及 AI测试Agent建设工作,推动Agent产品质量体系建设;
- 负责 Agent 多维度测试体系的设计与持续演进,覆盖Agent白盒测试、端到端功能测试、自动化测试、专项测试等;
- 针对 Prompt、RAG、Tool Use 等核心环节,研发自动化测试工具、自动化评估工具(如 LLM-as-a-Judge),将模糊的生成式体验转化为可量化的技术指标;
- 分析从代码变更、架构调整到模型策略优化全过程中的工程与算法风险,建立覆盖全链路的异常检测与预警机制;
- 参与技术攻关,解决复杂测试问题,并积极推动测试技术创新。持续优化测试流程、方法和工具,提升团队测试效能。
职位要求
- 本科及以上学历,计算机科学、软件工程、人工智能或相关专业;
- 熟悉 Python 或 Go,具备扎实的计算机基础,有大型复杂系统测试开发经验,熟悉性能调优、全链路追踪或自动化基建者优先;
- 理解大模型基本原理,有 Agent 架构或策略质量保障经验,能独立设计效果度量标准;
- 能解决传统的逻辑缺陷、性能瓶颈等确定性问题,也能通过数据驱动、概率统计等手段应对模型输出的不确定性挑战;
- 具备良好的业务体感与数据敏感度,能够快速跟进 AI 领域前沿技术并转化为实际的质量保障手段。具备自驱力,对提升测试效率有持续思考和推动能力。