岗位职责
- 模型研发与微调:负责具体业务场景下大语言模型及多模态大模型的训练与调优,持续提升模型在生成、理解、交互上的表现;
- 多模态生成:了解Diffusion Models、GAN、VAE等生成式技术,解决图像/视频生成的质量、可控性、采样效率及跨模态对齐等核心问题;
- 场景化落地:深入理解业务需求,将大模型能力转化为AIGC创意生成、视频智能化特效、智能对话、代码生成等具体产品方案,实现技术价值闭环;
- 前沿技术跟踪:跟进业界顶尖Paper与开源动态,保持团队技术领先性,通过技术创新解决业务中的极端边界问题。
职位要求
- 本硕博学历均可;计算机、人工智能、数学相关专业;
- 对基于图像、视频、语音、文本等模态内容的各类算法有一定的理解,并在如下一个或多个相关方向有深入研究:GAN 、扩散模型、图像生成、多模态等;
- 具备扎实的编程功底,熟悉Pytorch等主流深度学习框架,熟练使用C++/ Python等至少一种编程语言,熟悉Linux开发环境;
- 在顶级会议或期刊上发表过有影响力的学术论文或在重要算法比赛中取得过优秀名次的候选人优先;
- 参与过大规模语言模型、通用图像生成模型、AIGC相关产品落地者优先。