岗位职责
- 为小红书主站、基座大模型等业务提供统一高效的数据库服务,完善数据库的AI能力;
- 承担多模态数据库核心引擎的架构设计与研发落地,研发向量索引(HNSW、IVF 等)、全文倒排索引及多路混合检索能力,持续优化召回质量与检索性能。
- 构建面向图像、文本、音视频等多模态数据的计算引擎,打通批量预处理与模型推理的一体化链路。
- 设计并实现分布式存储、计算调度、数据分片与一致性协议等核心能力,保障系统的高可用、可扩展与稳定性;面向海量多模态数据场景,深入分析并优化查询性能、存储成本与资源利用率,持续提升系统的极致效能。
- 跟踪数据库、向量检索、AI Native 数据基础设施等方向的前沿进展,参与技术预研并推动方案在业务场景中落地。
职位要求
- 计算机相关专业背景,熟练掌握至少一门主流编程语言(Go / Python / Java 等),具备扎实的工程实现能力;
- 具备良好的技术热情与自驱力,面对复杂问题能够独立思考、快速学习,愿意在数据与大模型交叉领域持续深耕;
- 深入理解大数据技术体系,熟悉 Spark、Flink、Kafka、Hive、HDFS 等主流组件的原理与实践;
- 对大模型技术栈及产品生态有较为深入的了解,关注前沿进展;
- 熟悉数据中台、机器学习平台等系统级平台的开发或使用经验。