岗位职责
- 熟悉视频生成、大语言模型(LLM)、视觉语言模型(VLM)及多模态大语言模型(MLLM)等大模型的数据处理全流程,包括数据采集、质量筛选、分布均衡等关键环节;
- 了解上述大模型的典型架构设计与训练策略,能准确把握pretrain、sft、rl等不同训练阶段的目标差异及其对应的数据需求,理解数据对模型性能提升的关键作用;
- 跟踪 Data-Centric AI 领域的前沿研究,系统复现代表性基线方法,并在此基础上开展对比分析、归纳总结与深度思考,最终形成结构清晰、观点明确的技术综述。
职位要求
- 硕士及以上学历,计算机科学、人工智能、数学或相关专业;
- 在AI领域顶级会议(如NeurIPS、ICML、CVPR、ICCV等)或权威期刊有论文发表经历;
- 具备扎实的计算机视觉基础,熟悉主流视觉算法与技术框架,拥有大模型数据构建、清洗、评估及训练的实际项目经验;
- 具备优秀的逻辑分析能力,能独立开展技术调研与问题分析,并提出切实可行的优化建议。 加分项
- 在CVPR、ICCV、NeurIPS等国际顶会有第一作者或核心作者论文发表;
- 对Data-Centric AI方向有持续关注与深入实践,具备较强的研究热情。