岗位职责
- 负责大模型 Agent 评估、强化学习和数据制造所需的大规模沙盒平台建设;
- 负责面向模型训练/研究场景下 Agent 框架的研发与维护,支持强化学习、数据生成、自动化评估和实验复现等业务需求;
- 解决高并发任务执行场景下全链路的性能、稳定性问题,与业务紧密协作,优化相关任务流程、建设配套的平台基础设施,保障训练/实验/评估等流程高效、准确执行;
- 支持各类评估 bench 及运行环境接入。
职位要求
- 精通 Python,具备扎实的软件工程能力与系统设计能力,能在复杂系统中推进架构落地;
- 熟悉大模型与 Agent 相关应用技术,理解模型调用、工具调用、上下文管理、任务执行、日志 Trace 和结果评估等核心链路;
- 熟悉 Go 语言,熟悉 Linux、Docker、Kubernetes、容器网络、镜像构建、CPU / 内存 / 集群调度中的多项;
- 了解大模型训练流程和基本原理;
- 具备良好的软件工程能力,重视模块化设计、测试、日志、性能和稳定性治理;
- 具备良好的问题分析与解决能力,能高效利用行业前沿 AI 工具提升研发效率,并能与算法和平台团队协作推进落地。