岗位职责
- 大规模图文数据挖掘、整理、生成等工作
- 多模态大模型的训练和调优
- 模型部署与压缩
职位要求
- 深入理解Transformer、注意力机制、自监督学习等核心原理,能进行算法创新与改进
- 熟悉CLIP、LLaVA、MiniGPT-
- Qwen-VL、InternVL、GLM等主流多模态大模型架构
- 有多模态大模型全流程训练经验(数据构建→预训练→微调→评估)
- 有视觉问答/图文检索/多模态对话等至少一个方向的落地经验
- 有大规模多模态数据挖掘、清洗与治理经验
- 精通Python/PyTorch,具备从研究到生产的全链路工程化能力