岗位职责
- 与机器学习背景同事共同合作,研发Long-Running Multi-Agent Harness、构建Multi-Agent RL Agent基建;
- 协助算法同学进行大规模复杂RL环境构建,保障Multi-Agent场景训练、评估的稳定性。
职位要求
- 具有丰富的工程框架开发经验,熟悉操作系统及各类多任务场景主流调度策略和实现,熟悉多进程效率优化、异步框架优化的算法理论;
- 对现有主流Coding Agent框架,包括但不限于Claude Code、Codex的实现细节和动机有深入的研究;有扎实的工程基础,熟悉前后端开发、容器、沙盒等工程领域;
- 了解语言模型和强化学习,对AI进行复杂任务有热情和信仰;
- 工作主动性、行动力强,目标驱动,交流沟通、团队合作意识强;能迅速熟悉字节跳动内外部平台工具使用,具有主动提升效率的意识。