岗位职责
- 负责数据计算平台or数据湖存储引擎设计和开发,支持万亿级数据的交互式圈人、洞察、归因、报表场景。
- 负责数据or模型训练迭代产品研发,能提供架构设计和优化方案,并从技术上推进产品的快速迭代。
- 紧跟业界前沿创新场景的技术解决方案,比如数据湖技术和大模型迭代技术。
职位要求
- 熟练掌握C++、多线程、网络通信、高性能优化,或者熟练掌握Java开发和调优、并发编程模式,有丰富Unix/Linux环境开发经验。
- 具备丰富的数据开发经验,熟悉Hadoop、Hive、Spark、flink等体系结构,并有实际开发经验。
- 熟悉Impala/Presto/GreenPlum/Clickhouse等MPP数据库,对各数据库的优劣和适用场景有深入理解,有实践经验者优先。
- 熟悉paimon/iceberg数据湖技术
- 熟悉分布式技术并有实践经验(rpc框架, nosql存储),对kafka等消息中间件有深入了解。
- 大学本科及以上学历,1年以上计算机相关工作经验,有强烈的求知欲和较强的学习能力,对技术充满热情。