岗位职责
- 负责语音业务相关服务(语音合成/语音转换/语音识别)的系统架构设计与工程实现,主导基于FastAPI/Triton Server等框架的高性能服务开发;
- 优化语音算法在工程化落地中的性能表现,设计高并发、低延迟的语音处理系统,确保服务稳定性和横向扩展能力;
- 深入理解语音算法原理,熟悉模型压缩、量化及推理加速方案;
职位要求
- 计算机科学/电子工程/应用数学等相关专业,硕士3+/本科5+年语音领域开发经验;
- 精通Python/C++,熟悉FastAPI等Web框架,具备Triton等模型服务化经验;
- 深入掌握PyTorch/TensorFlow生态,具备以下至少一项经验: 语音合成中的FastSpeech/VITS/Diffusion/Speech LLM等序列建模优化; 语音识别中模型的解码加速或流式处理优化; 语音转换中的实时特征提取与声码器优化; 有以下经验者优先:
- 热爱游戏者优先;
- 主导过日均千万次调用量级语音系统设计;
- 在Interspeech/ICASSP等会议发表过语音相关论文;
- 具备优秀的跨团队协作能力,能清晰拆解技术方案并推动落地。