岗位职责
- 负责 Hive、Spark、Presto 为基础构建的大数据查询引擎开发,强化稳定性,优化能效,提升扩展性以应对增长的用户需求。
- 构建基于 Delta Lake、Iceberg 为基础的结构化、半结构化存储解决方案。
- 深入理解系统软硬件特性,关注线上运行状态,分析和解决线上问题,推动业务需求的解决方案落地。
职位要求
- 扎实的计算机理论和编程基础,了解常用的数据结构和算法。
- 熟练掌握 Java 语言,良好的代码风格和测试习惯,熟悉软件开发流程。 加分项
- 参与或主导线上系统研发,在大规模、高性能、高并发领域有一手开发运维经验者优先。
- 在分布式查询、调度或其他任一领域有深入一手经验。在 Hadoop 生态系统(HDFS,YARN,Hive,Spark,Presto,HBase 等)有开发或开源社区贡献经验者优先。
- 熟悉底层系统,包括但不限于存储、网络、OS,在线上稳定性分析和优化有实战经验者优先。