岗位职责
- 负责企业级数据仓库设计、建模、规范以及研发工作;
- 深入理解业务需求,规划数据仓库建设的整体方向和技术路线,构建快速、准确、灵活、实用的数据仓库,挖掘发挥数据的价值;
- 保证数据仓库的及时、准确、稳定产出,构建好用的数据仓库;
- 打造行业一流的数据仓库团队;
- 与小伙伴一起调研和实践热门数据仓库组件和技术(数据湖、TiDB、FlinkSql、实时数仓等);
- 探索 AI 与数仓的深度融合,推动 AI Agent、大模型在数据开发、数据治理、智能分析等场景的落地应用;
- 建设数仓智能体(Data Agent),实现自然语言驱动的数据查询、指标解读、异常归因等能力,降低数据使用门槛;
- 负责数据仓库的 AI 赋能体系搭建,包括但不限于:智能 ETL 开发辅助、数据质量智能巡检、元数据智能管理、智能运维等;
- 跟踪业界 AI+Data 前沿技术(Text2SQL、RAG、LLM4Data 等),结合业务场景进行技术选型与落地,推动团队 AI 能力建设。
职位要求
- 精通Unix/Linux操作系统下Java或Scala开发,有良好的编码习惯,有扎实的计算机理论基础;
- 熟练掌握大数据处理技术栈,有丰富的Hadoop/Spark的实际项目使用经验,使用过Flink/Doris/Holo等更佳;
- 大数据开发工作至少5-10年,有Hive数据仓库开发经验,有实时数据仓库开发经验者更佳;
- 具有优秀的业务理解能力、自我推动力,有较强的逻辑分析能力,对数据敏感,对大数据处理和分析技术充满激情;
- 熟悉数据仓库建设生命周期和流程规范,并掌握主题建模、维度建模理论者优先;
- 了解大模型原理与应用,有 LLM/RAG/Agent 等 AI 技术在数据领域落地的实践经验者优先;
- 熟悉 Text2SQL、智能数据治理、AI 辅助 ETL 开发等方向,具备将 AI 能力融入数据开发流程的意识和能力;
- 持续关注 AI+Data 前沿技术动态,有较强的学习能力和技术热情,愿意探索大模型与数仓的深度结合。