岗位职责
- 负责可观测体系研发工作,围绕 Metrics、Logging、Tracing、Profiling 四大支柱,从全栈领域展开可观测基础能力建设;
- 负责监控平台、全链路追踪、日志服务、计算引擎(流式分析、实时告警、时序检测等)、告警、eBPF 等可观测相关技术架构及产品设计;
- 保障可观测相关基础服务,在高并发环境下的高性能、高可用,推动技术、产品持续优化迭代,支撑国内和海外可观测架构设计、数据合规、基建稳定性保障等工作;
- 落地 AI Infra 可观测、AI 应用可观测、可观测 AI+ 等相关技术,提高 AI 场景稳定性以及传统可观测产品使用体验和效率。
职位要求
- 本科及以上学历,计算机、软件工程等相关专业;
- 精通 Java、Go、Python语言中的一种,熟悉并发编程、分布式系统、性能优化等,有扎实的编程基础;
- 熟悉云原生可观测性体系的相关产品及组件,包括不仅限于:OpenTelemetry、CAT、SkyWalking、Prometheus、VictoriaMetrics、ELK、ClickHouse、eBPF 等,了解 Kubernetes 基本原理并能运用;
- 熟悉基础技术开源组件,如 Linux、网络、存储、MQ 等,深入了解细节,掌握实现原理优先。 【加分项】: 熟悉和使用 AI 场景相关技术,包括不仅限于:PyTorch、Spring AI、Langfuse、OpenClaw 等。