岗位职责
- 聚焦大模型的应用侧创新,包括RAG检索增强、LLM可控知识生产、LLM推理加速等问题,解决大模型业务落地的技术障碍;
- 大模型前沿探索,包括LLM4Rec、AIGB、时序大模型等,推动大模型子领域的技术创新,沉淀行业领先的技术能力;
- 协同跨团队技术和业务同学共同达成技术和业务目标。
职位要求
- 计算机相关专业获得硕士学位, 博士优先, 发表过大模型相关研究AI顶会论文优先;
- 有NLP基础背景,对NLP主流大模型如GPT4/O1/Claude/PaLM/LLaMA等的原理和差异有深入的理解,有实际项目经验优先;
- 熟练掌握主流深度学习框架pytorch/tensorflow,大模型训练框架Megatron-LM/Deepspeed等多机多卡方案,有百亿/千亿NLP大模型训练调优经验优先;
- 熟悉常见的模型轻量化技术,如量化/剪枝/蒸馏等,熟悉onnx/tensorRT;
- 有良好的代码开发能力,有开源项目开发经验优先;有良好的沟通能力和项目主导经验;
- 具备较强的沟通能力,主动性和团队协作精神。