岗位职责
专注于数据湖场景下向量化和多模态数据存储和分析系统的研究、探索和开发,具体职责包括:
- 探索和研究高效可扩展的向量索引和分级存储算法,支持超大规模向量数据存储和检索;
- 探索和研究高性能的多模态数据检索和查询算法,支持大数据AI一体化场景下的融合分析;
- 分析现有向量索引算法和典型负载的性能瓶颈,提出并实现创新的优化技术;
- 结合阿里云Milvus和EMR 产品服务,提供可靠高效的向量存储和检索方案,支持不同行业和规模的客户场景;
- 面向数据湖仓场景构建业界领先的多模态数据查询分析解决方案。
职位要求
- 扎实的工程能力,优良的编程风格,熟悉C++/Java语言和常用设计模式,具备复杂系统的设计开发调试能力;
- 优良的沟通表达能力、团队合作意识和经验;具备快速学习的能力,以及深入钻研技术问题的耐心;
- 熟悉计算机体系结构基础知识,有扎实的操作系统和数据库系统理解和相关研究经验。 加分项:
- 有突出的学术背景和创新研究能力;
- 对向量数据存储和索引场景的系统优化或前沿算法有深入务实的经验;
- 具有大数据和分布式数据库系统的开发和优化经验。