岗位职责
- 产品规划与架构设计:深入理解企业级数据湖与 AI Agent 数据基座的市场需求,跟踪 Lakehouse 向 Agentic Lake 的演进趋势,围绕统一元数据治理、全模态数据管理(结构化/半结构化/非结构化/向量/Agent Context)、五级索引体系等核心能力,完成产品规划、功能定义与架构设计,构建面向 AI Agent 的 Agent-Ready 数据湖产品体系。
- 产品管理与跨团队协同:负责 DLF 产品全生命周期管理,协调 Data+AI 等多引擎协同团队,联动技术研发、测试、解决方案架构师、销售及运营等多职能团队,确保产品从设计到上市的高效交付。
- 开源生态与市场竞争力建设:深度参与 Apache Paimon、Apache Fluss、Apache Iceberg、Lance 等开源项目的产品化策略制定,持续跟踪国际头部竞品及业界主流云厂商在统一 Catalog、湖仓一体领域的产品动态,结合湖流一体(Lake-Streaming)、全模态湖仓存储、全模态索引等差异化能力,制定竞争策略并推动产品市场优势持续扩大。
- 客户价值交付与场景落地:面向汽车(自动驾驶数据管理)、金融(实时风控)、零售(多媒体数据治理)、互联网(推荐/电商)等重点行业,梳理客户数据湖建设与 AI 应用的核心场景需求,设计 Tables 接口与 Files 接口的双层服务能力,推动 Agent 检索召回 API、Context API 等新型接口的场景化落地,提升客户转化与留存。
- 产品体验迭代与技术趋势洞察:持续追踪用户反馈,围绕行列级权限管控、数据生命周期管理、数据质量、湖格式性能等维度优化产品体验;紧跟 AI Agent、RAG、向量检索、流批一体等前沿技术发展,将技术趋势转化为产品创新机会,驱动产品持续迭代升级。
职位要求
- 具备数据湖、大数据平台或云计算基础设施领域的产品或项目经验,熟悉主流湖格式(Paimon、Iceberg、Hudi、Delta Lake)及元数据管理(Hive Metastore、Glue Catalog、Unity Catalog)技术体系,了解分布式存储与计算引擎(Flink、Spark、Ray)的基本原理与适用场景,有数据湖或湖仓一体相关产品经验者优先。
- 具备 AI 与大数据融合领域的知识储备,理解向量索引(DiskANN/HNSW)、全文检索、语义检索等信息检索技术,了解 AI Agent、RAG、Embedding 等应用范式对底层数据基座的需求,能够将 AI 场景需求转化为数据平台产品能力定义。
- 具备深厚的技术理解力与产品架构能力,能够定义多模态数据的统一管理模型、设计分层产品架构(存储层/索引层/服务层/接口层),理解企业级能力(权限、审计、生命周期)的设计要点,能将复杂技术方案简化为客户可理解的产品价值主张,从客户视角驱动技术选型决策。
- 具备优秀的产品经理综合素质:能够熟练运用 AI 辅助工具提升工作效率;具备出色的文档撰写能力,能够清晰表达产品架构意图与技术方案;具备跨团队沟通与项目推动能力,能够在研发、开源社区、销售、客户等多方之间高效协调;执行力强,适应快速迭代的产品节奏。
- 本科及以上学历,计算机科学、软件工程、数据科学或相关专业,3年以上云计算/大数据/AI 平台领域产品管理或技术项目经验;有开源社区参与经验或技术开发背景者优先。
- 具备持续学习新技术的热情与快速构建新领域认知的能力,以客户价值为导向、拥抱变化达成结果等品质。