岗位职责
- 3D动/静态生产:利用三维重建、生成模型、多模态大模型对单图、视频完成动态物体/静态场景重建、生成、编辑,并得到可交互的3D、长时序视频;
- 世界模型构建:结合具身智能、自动驾驶等数据探索空间智能的统一范式,完成环境感知、智能体预测、决策规划等任务并得到未来状态和未来传感器信息,为强化学习提供基座;
- 产线落地与性能优化:与具身智能、自动驾驶、智能导航等业务协同,完善仿真数据链路;
- 跟踪学术界和工业界在生成式AI/世界模型相关领域的最新进展,保持公司在该领域的技术领先地位。
职位要求
- 计算机科学、人工智能、电子信息等相关专业研究生学历,博士优先;
- 扎实的深度学习/机器学习/数学功底,熟悉Transformer、Diffusion Models、Reinforcement Learning、LLM等相关技术;
- 重点技能: a. 至少深入掌握一项: i. SfM, MVS, NeRF, 3DGS 等三维重建及渲染算法 ii. Diffusion Models, Video LDM 等图像、视频、3D生成式算法 b. 精通 Python & PyTorch、具备良好代码规范;熟悉分布式训练、Profiling、CUDA 优化者加分
- 在顶级会议(如CVPR、ICCV、SIGGRAPH、NeurIPS、ICML、ICLR)发表过相关论文者优先;
- 有三维重建、图像/视频生成算法项目落地经验者优先;
- 具备较强的学习能力,能够快速掌握新技术,对新技术充满好奇心,具备高度的自驱力和韧性。