岗位职责
- 研究和优化 Agent Harness,包括工具调用、上下文与记忆、任务规划、Multi-Agent、反思及错误恢复等机制。
- 搭建 Agent 实验与评测体系,通过 Benchmark 和执行轨迹分析,提升复杂任务的成功率、稳定性与效率。
- 将真实任务中的反馈沉淀为训练数据、Eval 和 Reward 信号,推动模型与 Harness 协同迭代。
- 跟进前沿 Agent 研究,完成原型验证并推动有效方案落地。
职位要求
- 计算机、人工智能或相关专业应届毕业生,具备扎实的编程和实验能力。
- 熟悉 LLM、Agent、Tool Use、Context Engineering、Evals 等基本概念。
- 对 Agent 产品有深入使用或开发经验,能够独立搭建原型、分析问题并验证方案。
- 有 Agent、评测框架或自动化实验平台相关论文、开源项目者优先。