岗位职责
- 负责LLM在线服务部署、性能调优与推理加速,确保高并发、低延迟、高可用的模型服务,针对复杂推理链路进行性能瓶颈分析,建立推理质量与效率的评估闭环;
- 负责AI Agent系统的整体架构设计、开发与优化,构建具备规划、记忆、工具调用、反思、多Agent协作等核心能力的智能体系统;
- 设计并实现Agent框架的核心模块,包括任务分解引擎、工具集成层、长短期记忆系统、状态机与决策引擎,确保Agent在复杂任务中稳定可靠运行;
- 开发Agent与外部系统(如API、数据库、知识库、RAG系统)的安全、高效交互机制,支持函数调用(Function Calling)、ReAct、Plan‑and‑Execute、Multi‑Agent等不同工作流;
- 与产品经理、算法工程师、前端工程师紧密协作,持续优化Agent的执行效率、成本控制、容错机制与用户交互体验,解决生产环境中遇到的实际系统问题。
职位要求
- 具备优秀的架构抽象与平台化落地能力,必需负责过C端高并发系统的设计、开发和稳定性保障;
- 精通Python,熟练使用CrewAI、LangGraph、OpenAI Agents SDK等Agent开发框架,至少有一个完整的Agent项目开发经验;
- 熟悉大语言模型(LLM)的调用机制、Prompt Engineering、Function Calling及Tool Use,熟悉ReAct、CoT、ToT等主流Agent推理范式;
- 具备扎实的分布式系统与后端开发能力,熟练使用FastAPI、Docker、Kubernetes等技术,有构建高并发、可扩展AI服务经验者优先;
- 良好的问题分析与调试能力,能够独立定位Agent执行失败、幻觉、工具调用异常等问题,并提出系统性解决方案。