岗位职责
- 负责阿里云加速计算生态建设,围绕自研 AI 加速芯片,构建从芯片底座(SDK、驱动、编译器、算子库、框架适配)到云上商业化交付的完整产品体系。深入理解客户在大模型推理与训练、多模态、搜索推荐、AI for Science、文生视频等场景的需求和行业技术发展趋势,通过竞品对标、用户调研等方法完成产品定义。产品范围涵盖分行业容器镜像、开发者工具链、性能分析平台、迁移工具、运行时优化等核心能力。
- 负责分行业容器镜像体系的产品化。基于芯片厂商提供的基础镜像和组件包,按垂直场景组合出开箱即用的行业镜像(含预装框架、模型权重、调优参数),定义镜像分层架构、Tag 命名规范、构建与验证流程、VPC 分发加速和迭代保障机制,让客户一条命令拉起已调优的完整环境。
- 负责开发者工具链与产品入口建设。规划并推动 官方文档站点、兼容性矩阵查询、在线迁移工具等产品的定义与落地,降低客户从 GPU 平台迁移到自研芯片的接入成本。
- 对产品商业闭环负责。制定容器镜像、开发者工具、性能服务等产品的上市计划,制作产品的发布和推广材料,并组织产品的上市推广,支撑商业化客户从评估、POC、试用到规模化采购的全流程。
- 推进生态与合作。推动与芯片厂商在 SDK 发布节奏、镜像构建 CI/CD、问题协同诊断等环节的紧密协同;与模型与框架社区(vLLM、SGLang、DeepSpeed 等)建立上游优先(upstream-first)的贡献与回流机制,参与开源社区治理与贡献者体系运营;推动训练和推理引擎、行业解决方案伙伴合作,构建覆盖五大垂直场景的完整生态。
职位要求
- 5 年及以上产品经理经验,具有 GPU 云、AI Infrastructure、异构算力软件生态或 IaaS 平台和商业化产品经验者优先。
- 有全链路产品打造经验,包括用户调研、性能指标定义与商业模型构建。深入开发者、AI 应用及训练场景,通过需求调研与竞品对标形成洞察驱动。有容器镜像体系、开发者工具链或性能分析平台产品经验者优先。
- 能综合 AI 链路和垂直行业场景,规划产品 Roadmap,优化产品核心能力,推动关键特性及关键性能指标落地。熟悉大语言模型推理 / 训练、多模态、搜索推荐等至少两个垂直场景的技术架构和性能特征。
- 具备算法基础和模型优化基础,理解 Transformer、Attention、KV Cache、Dense/MoE 等常见模型结构及并行策略。了解量化(FP8 / INT8 / MXFP4)、PD 分离、稀疏 Attention 等推理优化技术。
- 熟悉 AI 加速芯片软件栈(驱动 / 编译器 / 算子库 / 框架适配),理解从芯片 SDK 到客户可用产品之间的工程断层,有开源社区参与或治理经验者优先。
- 出色的项目管理、推动能力和执行力,有极强的成本和进度意识,可快速定位并解决问题。
- 学习能力强,能够快速适应新领域,跟进快速迭代的业界趋势,有很强的自驱和抗压能力。