岗位职责
- 为大规模推荐系统设计和实现合理的数据系统;
- 生产系统的Trouble-shooting,设计和实现必要的机制和工具保障生产系统整体运行的稳定性;
- 打造业界领先的流式计算框架等分布式系统,为海量数据和大规模业务系统提供可靠的基础设施。
职位要求
- 对大数据系统有深入的了解,在生产环境有TB级别Flink实时计算系统开发经验,深入掌握Flink DataStream、FlinkSQL、Flink Checkpoint、Flink State等模块,有Flink源码阅读经验优先;
- 熟悉常见消息队列原理和应用调优,有Kafka、Plusar、RocketMQ等项目源码阅读经验优先;
- 熟悉Java、C++、Scala、Python等编程语言,有出色的编码和Trouble-shooting能力;
- 乐于挑战没有明显答案的问题,对新技术有强烈的学习热情,有PB级别数据处理经验加分;
- 有数据湖开发经验,熟悉Hudi、Iceberg、DeltaLake等至少一项数据湖技术,有源码阅读经验优先;
- 熟悉其他大数据系统经验者优先,YARN、K8S、Spark、SparkSQL、Kudu等;有存储系统经验加分,HBase、Casscandra、RocksDB等。