岗位职责
- 负责可灵系列视频生成大模型的实时化需求, 包括研发落地各种前沿的步数蒸馏算法, 探索实时流式生成算法方案;
- 负责生成大模型的高效Attention 研发, 包括 Sparse / Linear Attention 的训练以及蒸馏Full-Attention;
- 负责少步数视频生成大模型的极致效果优化, 包括探索在少步数设置下的强化微调和对抗微调, 进一步提升模型生成效果。
职位要求
- 硕士及以上学历,数学、计算机、自动化、电子等专业优先;
- 掌握扩散模型原理和压缩加速手段(如: 步数蒸馏,包括CM / Score-Distillation ), 具备公式推导和证明能力, 有过相关的研究经历和实践经验者优化;
- 有过使用 DPO / LoRA 等技术对模型进行轻量微调者优先;
- 熟练掌握线性线数, 概率论, 信息论, 凸优化等基础知识,了解矩阵论, 随机过程等;
- 精通PyTorch, 熟练大模型并行框架的使用(如: DeepSpeed / Megatron);
- 精通Python, 掌握Triton和C++, 了解CUDA或有实践经验者优先。