部门介绍
字节芯片研发团队目前工作主要集中在芯片设计环节,主要围绕字节自身业务展开芯片探索,为字节多项业务的专用场景定制硬件优化,设计多款基于先进半导体工艺的云端复杂芯片,以期提升性能、降低成本。早期若干芯片项目已经进入到量产部署阶段,有多次一版成功的投片经历,所用工艺包含多个主流的先进工艺节点。与基础设施各团队之间工作的整体协同,能更容易和更好地发挥芯片研发的价值。
- 负责大模型等业务模型在自研芯片进行适配性和性能评估、软硬件协同优化工作;
- 负责AI模型整图或者算子编译框架优化,实现较高硬件利用率和整体性能,提升编译框架的通用性与优化能力;
- 构建分布式推理系统,推理框架极致调优,实现较优的在线部署吞吐和高性价比;
- 模型量化、稀疏、蒸馏等推理部署的探索和落地方案。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 深入理解AI加速硬件的体系结构和并行计算;
- 熟悉深度学习框架和软件栈,熟练使用C/C++、Python等编程语言;
- 熟悉ONNX/TensorFlow/PyTorch等主流深度学习框架;
- 有主动学习、问题分析与解决能力和较强自驱力;具备良好的跨团队协作能力。 以下为加分项:
- 熟悉编译器和代码优化技术,有MLIR、TVM等相关开发经验;
- 熟悉GPU或者主流AI芯片架构,有相关算子优化、图编译优化经验、硬件评测经验;
- 对LLM或多模态领域模型有深刻理解,例如Qwen、Deepseek等;
- 有AI加速硬件的量化工具开发经验;
- 熟悉AI服务器和集群架构,熟悉芯片和集群互联相关技术,有实践开发经验;
- 有vLLM/SGLang等推理框架开发和调优经验,有部署实践相关经验。