岗位职责
- 探索多模态大模型的高效训练,包括预训练、SFT、及RLHF等技术;
- 探索高效的视觉编码器结构、对齐范式、训练策略、数据清洗、质量分级、数据合成等;
- 探索多模态大模型的逻辑推理、planing、完成复杂任务的能力;
- 探索原生多模态大模型的架构与训练范式;
- 探索图像、视频、音频的全模态大模型;
- 结合淘天业务,推动多模态大模型在搜索、推荐、广告等业务中的应用。
职位要求
- 计算机视觉、自然语言处理、语音处理、机器学习、数据挖掘、人工智能等相关专业的硕士或博士;
- 具备较好的编程能力,动手能力强,熟练使用至少一种开源深度学习框架;
- 优秀的英文文献阅读能力,有人工智能顶会顶刊论文发表者优先,ACM竞赛获奖者优先。