岗位职责
- 构建AI-in-Database能力:负责为开发者和企业训练并部署前沿AI模型,通过与数据库深度集成,构建支持各类AI系统的核心能力(包括但不限于:内容生成、语义搜索、RAG、智能数据分析、个性化搜索推荐等);
- 前沿模型设计与训练:主导设计和训练行业领先的AI模型,包括但不限于:文本嵌入模型(Text Embedding)、多模态嵌入模型(Multi-Modal Embedding)、重排模型(Reranker)、大型语言模型精调(LLM Post-Training)等;
- 模型效果优化与训练链路提升:持续优化AI模型效果,追求达到业界领先水平(SOTA);设计并优化监督微调(SFT)和强化学习(RL)的训练链路。
职位要求
- 编程基础扎实:熟悉Python或C++,具备优秀的编程能力和工程实践素养;
- 深度学习框架熟练:熟悉PyTorch、TensorFlow等至少一种主流深度学习框架;
- 训练经验:拥有模型训练实战经验,熟悉Ray、Slurm等至少一种分布式训练框架;
- 算法模型与领域经验:深入理解并具备在以下至少一个或多个领域的机器学习算法/模型架构成功落地经验:自然语言处理(NLP)、多模态学习(Multi-modal)、大型语言模型(LLM)、搜索/推荐/广告(Search/Recommendation/Ads);
- 学术研究/竞赛背景(优先):在顶级机器学习/人工智能会议或期刊(如:NeurIPS、ICML、ICLR、AISTATS、MLSys、AAAI、ACL、EMNLP、COLING、JMLR、Nature及其子刊)发表过论文,或在知名算法竞赛(如Kaggle等)中取得优异成绩者优先。