部门介绍
字节跳动Seed团队成立于2023年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed团队在AI领域拥有长期愿景与决心,团队研究方向涵盖MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE等超过50个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包App用户量在中国市场排名第一,豆包大模型日均Token调用量行业领先。
- 负责以自研推理引擎为中心的在线推理服务和近离线批式推理任务框架,设计开发超大规模机器学习系统架构,解决系统高并发、高可靠性、高可扩展性等技术难关,为搜索、推荐、审核等业务提供深度模型推理全场景端到端解决方案;
- 针对PyTorch、TensorFlow等框架提供高自动化、极致性能的模型优化方案,技术方案不限于子图匹配、编译优化、模型量化、异构硬件等;
- 面向全球多地域超大规模GPU算力集群,通过弹性调度、GPU超卖、任务编排等方式不断提升算力利用率;
- 与算法部门深度合作,进行算法与系统的联合优化。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 熟练掌握Linux环境下的C/C++与Python语言,有机器学习系统或搜广推推荐系统相关经验;
- 熟悉至少一种机器学习框架(TensorFlow/PyTorch/MxNet或其他自研框架);
- 有以下至少一项的背景知识与经验:GPU编程、编译器、模型量化、GPU集群调度;
- 具有独立解决问题的能力,良好的团队合作精神,具备优秀的复杂问题拆解能力;
- 有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
- 有良好的工作文档习惯,及时按要求撰写更新工作流程及技术文档。 加分项:
- 有推荐/广告/搜索离在线推理系统架构经验;
- 理解GPU硬件架构,理解GPU软件栈(CUDA,cuDNN),具备GPU性能分析的经验。