岗位职责
- 广告各类在线业务的离线和实时数据体系建设,完成数据主题域的模型设计、实现和维护;
- 数据服务接口及产品需求研发迭代,代码回查、BUG修复及日常服务运维;
- 针对海量数据处理和查询需求,设计适应业务变化的合理的数据体系,满足多样性的需求。
职位要求
- 计算机相关专业本科以上学历,掌握计算机组成原理、计算机系统结构、计算机网络和操作系统等计算机基础理论;
- 对Hadoop生态圈的相关技术,比如MapReduce、Spark、Hive、Flink的原理掌握并且有实战经验;
- 熟练掌握SQL, 可以使用SQL进行复杂的分析, 并给予执行计划掌握并对SQL进行调优处理,熟练使用Java、Python和Shell等编程语言进行数据加工处理;
- 从事数据仓库领域2年以上,熟悉数据仓库模型设计、ETL研发,有海量数据处理经验;
- 掌握数据分层架构和维度建模方法, 了解数据指标体系建设和数据分析方法;
- 善于沟通,工作积极主动,责任心强,具备良好的团队协作能力。 额外加分项:
- Github等开源社区贡献者;
- 具有数据挖掘和统计学相关背景;
- 具备大规模分布式服务设计能力和经验。