岗位职责
- 负责自然语言处理算法的研发与落地,包括语言大模型的训练、检索增强 RAG、文本理解、文本生成以及智能体等能力,支撑业务场景需求;
- 参与数据集构建、数据清洗、标注质量评估,完成模型训练、调优、效果评估、错误分析,持续迭代优化模型精度与稳定性;
- 对接工程开发团队,将NLP算法转化为可交付方案,完成模型压缩、推理加速,保障算法在生产环境高性能稳定运行,并跟进不同应用场景下的产品化工作;
- 跟踪NLP前沿技术、论文与开源方案,结合业务做技术选型与方案调研,输出技术方案、实验报告,解决业务中的复杂文本问题。
职位要求
- 计算机、数学、人工智能、模式识别、统计学等相关专业,硕士及以上学历,具备良好的数据基础;
- 具备良好的编程基础,至少熟悉一种编程语言,如Python,C++,Java等;
- 深刻理解Transformer、BERT、GPT等主流模型原理,熟悉Attention机制、预训练方法;对大模型技术栈有深入实践者优先;
- 熟悉深度学习框架,如PyTorch/TensorFlow/PaddlePaddle等,熟悉Linux开发环境,具备良好的代码规范和工程落地能力;
- 在如下专业领域有项目实践经验者优先,如:工具调用、向量模型、分词、语义消歧、文本分类、实体识别、知识图谱等;
- 熟悉大模型算法的智能体落地,有知识检索、对话系统、行业智能体等领域落地者优先;
- 良好的沟通表达能力和团队协作能力,热衷技术,责任心强。