岗位职责
专注于视觉通用大模型的设计、优化与高效部署,具体职责包括:
- 研究高效的视觉通用大模型架构,应对复杂视觉任务,提升模型的准确性和泛化能力;
- 优化算子和通信机制,提升模型训练效率,降低硬件资源消耗,提高训练速度和资源利用率;
- 探索高效的训练策略,包括自适应学习率调整、正则化方法和优化算法选择,提升模型性能和稳定性;
- 设计和实现自动化评估方法,帮助研发团队及时发现模型不足,优化模型架构和训练策略;
- 研发数据过滤和标注相关模型,提高数据质量和可用性,为模型训练提供支持。
职位要求
- 计算机及相关专业的博士或硕士研究生,对人工智能和视觉模型有充分兴趣;
- 优良的编程能力,熟悉Python/C++语言和常用设计模式,具备复杂系统的设计开发调试能力;
- 具备良好的沟通表达能力和团队合作精神,有快速学习能力和钻研技术问题的耐心;
- 熟悉计算机视觉基础知识,有模型设计、训练优化或数据处理方面的经验;
- 加分项: -有视觉通用大模型开发和优化相关研究和开发经验; -产出过高水平的学术成果,如论文和专利; -具有大规模分布式训练或高性能计算方面的经验。