岗位职责
- 探索研究多模态理解、生成式、强化学习等前沿技术;
- 负责世界模型相关核心算法的研发与落地,包括但不限于视频生成、视频预测、视频编辑等方向;
- 探索面向游戏世界场景的新一代视频生成技术,构建具备可交互性、可编辑性、物理一致性和时空一致性的世界模型。
职位要求
- 人工智能、计算机科学、数学或相关专业,硕士及以上学历, 3+相关工作经验;
- 熟练掌握 PyTorch 等主流深度学习框架,具备扎实的编程能力与工程实现能力;能够高质量复现前沿论文,并推动算法从研究原型到工程实现;
- 深入理解 Diffusion Models、GANs、VAEs、Flow-based Models 等,具备图像生成或视频生成相关研究或实践经验;
- 有大规模 GPU 集群上的模型预训练、微调与后训练经验;具备多模态大模型(如 CLIP、LLaVA、Qwen 等)的训练或应用经验;
- 在 SIGGRAPH、CVPR、ICCV、NeurIPS 等顶级会议或期刊发表过相关领域的一作论文者优先。