岗位职责
- 设计多模态可控生成框架,支持键盘/手柄/轨迹/语音等多种输入;
- 研究稀疏控制信号下的高保真生成,探索条件控制范式在视频域的拓展;
- 实现轨迹控制、相机控制、运动控制、姿态控制的解耦与组合;
- 针对不同游戏类型设计专用控制模块;
- 研发多人协同操控视频生成能力,实现低延迟响应与帧间状态保持;
- 与引擎/Agent 团队协作,定义可控信号的标准化接口;
- 推动可控生成与 RL 后训练的联合优化。
职位要求
- AI 相关博士,计算机视觉/深度学习方向;
- 精通条件生成模型及多人多通道操控技术,熟悉扩散模型原理;
- 有相机控制、轨迹控制、姿态控制相关项目经验;
- 理解游戏引擎的输入输出逻辑与帧同步机制;
- 熟练使用 Python/PyTorch,有可控视频生成或条件生成相关方向论文;
- 有游戏 AI 或游戏开发经验者优先;
- 有实时/交互式视频生成项目经验者优先。