岗位职责
- 负责万亿级特征、样本与索引生产链路的设计、开发和维护,为阿里电商搜索、推荐、广告等业务提供高质量数据支持。
- 基于 Flink 建设大规模数据处理任务,持续优化计算性能、资源利用率、吞吐能力、延迟及稳定性。
- 深入分析任务运行瓶颈,解决数据倾斜、反压、状态膨胀、Checkpoint 异常、资源浪费等复杂工程问题。
- 参与特征、样本、索引平台建设,将共性能力抽象为标准化、配置化和可复用的平台能力。
- 完善平台的任务管理、质量校验、监控告警、故障诊断及成本治理能力,提升研发和运维效率。
- 深入理解业务目标,与业务、算法及上下游研发团队共同设计数据链路和技术方案。
- 参与系统架构演进和技术规划,推动超大规模数据场景下的工程能力沉淀。
职位要求
- 熟练掌握 Java,具备良好的编码能力和工程实践经验。
- 具备较强的工程意识,关注代码质量、系统稳定性、可维护性、资源成本和交付效率。
- 善于进行性能分析与优化,能够通过指标、日志、火焰图等手段定位系统瓶颈,并推动问题闭环。
- 具备平台意识,能够识别不同业务需求中的共性问题,完成能力抽象和产品化建设。
- 具备良好的沟通协作和复杂问题解决能力,能够主动推进跨团队项目落地。 加分项
- 乐于了解业务,具有搜索、推荐、广告、用户增长等相关领域经验。
- 具备特征平台、样本平台、实时计算平台或数据开发平台建设经验。
- 有超大规模 Flink 任务开发、性能优化或稳定性治理经验。
- 能够深入业务,与业务方、算法团队及上下游研发团队共同设计端到端解决方案。