部门介绍
围绕多模态理解、AIGC算法、实时互动,建立核心算法能力;探索前沿AI能力的边界,挖掘用户的潜在需求,打造创新产品功能。 持续提升算法核心竞争力,逐步拓展高频场景,助力灵光产品成功。
岗位职责
- 面向AGI创新产品,探索内容生成和创新互动模式。通过内容生成(图像/视频/3D),为用户打造全新的内容体验和交互模式;
- 结合产品场景,进行文生图、图像编辑、视频生成、3D生成模型的研究优化,解决生产质量、可控性、生成效率等关键问题;
- 基于SOTA基模,进行Continue Pretrain/SFT/RL相关的优化,评测模型能力,探索各种下游应用场景;
- 追踪领域前沿工作,包括但不限于实时视频生成、世界模型等方向,探索RLHF在视觉生成领域的scaling law等。
职位要求
- 具备扎实的大模型研发经验,深入理解DiT、Self-Forcing、RL算法、DMD蒸馏加速相关算法原理。有图像生成、视频生成或3D生成经验;
- 熟悉AIGC应用数据准备的全流程,包括数据采集、清洗、标注等,对于如何人工合成高质量训练数据有深入的理解;
- 具有出色的分析、解决问题的能力,能深入解决大模型训练、应用存在的问题,有自主探索解决方案的能力者;
- 优秀的编程能力,熟练使用pytorch。熟悉推理和训练模型调优,分布式推理训练加速,有实操经验优先。