岗位职责
- 设计与迭代下一代视频生成基础架构;
- 探索长视频生成核心技术:长上下文注意力、KV Cache 压缩、记忆机制等;
- 研究高压缩比视频 Tokenizer,推进多分辨率、多帧率统一建模能力;
- 主导千亿/万亿 token 级别视频预训练,定义 data mixture 与 curriculum learning 策略;
- 探索 Scaling Law,输出科学的 scale-up 路径,持续提升模型关键能力;
- 跟踪业界 SOTA,主导对比实验,输出技术路线决策与论文发表。
职位要求
- AI 相关博士,有顶会一作论文;
- 精通扩散模型与自回归生成的原理与工程实现;
- 有视频/图像生成模型从零训练经验,精通 PyTorch 及大规模分布式训练;
- 深度理解 Video VAE/Tokenizer 的设计取舍,3年以上相关研究经验;
- 有视频生成或扩散模型相关方向论文;
- 有业界核心产品研发经验或最新技术实战经验者优先;
- 主导过端到端视频基础模型项目者优先。