岗位职责
- 负责跟踪音视频生成、多模态大模型的前沿技术与发展动态,依据不同业务场景(如视频风格迁移、智能语音交互、音频内容创作等)开展模型应用的定制化开发,实现多媒体创新功能;
- 负责音视频生成、多模态大模型训练算法的优化工作,分析训练框架的性能瓶颈,改进训练框架及策略,运用数据并行、模型并行、流水线并行、通信优化等手段提升训练效率,最大限度提高硬件资源利用率;
- 负责音视频生成、多模态大模型推理算法的优化工作,从模型架构、推理框架适配、参数调优到并行加速等方面,全面提升模型的运行效率;
- 负责模型的工程化落地,与算法、产品、前端/客户端、后端等团队协同合作,打通模型链路,将音视频生成、多模态大模型从实验室阶段推进至生产部署阶段,确保其在实际业务环境中稳定运行。
职位要求
- 计算机、通信、信号处理等相关专业,本科及以上学历,3年以上算法研发工作经验;
- 精通Python,熟悉PyTorch、FSDP、DeepSpeed、Megatron等训练框架;
- 熟悉CUDA、AscendC、Triton、TileLang等异构语言,具备FlashAttention、Conv2d、Matmul、GroupedMatmul等算子加速经验优先;
- 熟悉主流音视频生成、多模态算法模型原理,具有模型训练适配、模型加速、模型量化、通算融合能力,具备多线程、并行计算开发经验,熟悉TensorRT-LLM、SGLang、vLLM等推理引擎优先。