岗位职责
- 负责打造可灵生成式大模型的视频基础设施,构建高性能多模态媒体处理系统,持续为模型提供高质量视频数据供给;
- 在大模型训练数据管线场景,持续提升音视频转码、切片算子的性能与兼容性,满足多样化音视频形态需求;
- 在图片、音频、视频处理技术领域,和数据算子紧密合作,推动音视频质量评估、多镜头规划、训练特征刷库等算子效果提升;
- 与模型算法、数据策略团队共同制定视频数据处理策略,以 Co-Design 方式推动数据处理能力和模型效果持续提升。
职位要求
- 计算机及相关专业本科及以上学历,3 年以上音视频开发优化经验;
- 精通C++,另熟练掌握一门语言(Go / Rust / Java / Python),具备扎实的系统编程能力、良好的数据结构和算法基础;
- 熟悉H.264、H.265等主流视频和图片编解码标准、熟悉AAC等音频编码标准,熟悉MP
- FMP
- TS、HEIF等媒体封装协议和解封装流程;
- 精通 FFmpeg 等主流媒体处理框架,能进行大规模重构、新特性开发和疑难问题修复;
- 善用 AI-coding 与大模型工具(硬性要求),认同 agentic 研发理念;
- 沟通务实,有较强的自我驱动能力。 加分项:
- 有视频生成或多模态大模型训练数据 Pipeline 开发经验,熟悉视频镜头切分、质量评估、Caption打标及数据分流等处理策略者优先;
- 有编解码算法、视频图像处理算法、VQA 算法研发经验者优先;
- 有直播、RTC、媒体处理等架构设计经验者优先,有音视频开源社区代码贡献者优先。