岗位职责
- 为大规模推荐系统设计和实现合理的离线/实时数据架构;
- 设计和实现灵活可扩展、稳定、高性能的存储系统和计算模型;
- 生产系统的Trouble-shoting,设计和实现必要的机制和工具保障生产系统整体运行的稳定性;
- 打造业界领先的离在线存储、批式流式计算框架等分布式系统,为海量数据和大规模业务系统提供可靠的基础设施。
职位要求
- 熟悉一个大数据领域的开源框架,Hadoop/Hive/Flink/FlinkSQL/Spark/Kafka/Hbase/Redis rocksdb/Elasticsearch/Parquet;
- 熟悉Java、C++等编程语言;
- 出色的编码和Trouble-shoting能力;
- 乐于挑战没有明显答案的问题,对新技术有强烈的学习热情;
- 有PB级别数据处理经验加分;
- 对某一大数据框架有原理/源码级别理解的加分。