岗位职责
- 参与多模态大模型VLM和生成模型(Diffusion)开发,从架构设计、数据建设、预训练和Post-training等维度提升多模态大模型效果和性能,跟踪大模型前瞻技术和趋势;
- 支持豆包手机相机&相册业务场景,包括但不限于基于VLM的拍摄引导,图片美学分析,图像美化Agent,以及豆包P图等业务。
职位要求
- 硕士学位及以上,计算机、数学、通信等相关专业;
- 扎实的编程功底和机器学习算法基础,对大模型有兴趣和热情,有想法且动手能力强;
- 有大模型(VLM/Diffusion)实际研发经验,有相机相册算法经验者优先,在CVPR/ICCV、NeurIPS/ICML/ICLR等会议上发表论文者优先。