岗位职责
- 优化大模型底座能力和商品语义理解能力,提升大模型在图文视频的分类、检索、检测、OCR等任务上的准确性;
- 优化大模型Agent的规划、推理能力,提升智能化运营效率;
- 参与多模态大模型的预训练、后训练、模型蒸馏等工作;
- 深入结合业务,发现业务痛点,基于大模型设计解决方案,开发并落地;
- 持续学习跟进大模型研究进展,将最新技术应用到实际业务中。
职位要求
- 有扎实的深度学习基础,熟悉pytorch、tensorflow等基础框架;
- 熟练掌握NLP或计算机视觉领域的基础理论与方法,至少在某个领域有深入研究或实践;
- 有大模型研究、训练和微调经验优先,有商品业务经验优先;
- 逻辑清晰,有激情,责任心强,团队合作、沟通能力佳。