岗位职责
- 语音生成算法的实现和研究;
- 跟踪语音前沿技术,了解最新的语音生成大模型、端到端语音大模型等先进技术。
职位要求
- 计算机/语音信号处理或相关专业,2027届及之后毕业的硕士或博士;
- 扎实的机器学习/深度学习算法基础,熟悉常见的生成式模型的基本原理和调优;
- 优秀的编程能力和良好的编码习惯;
- 熟练使用至少一种主流深度学习框架(PyTorch);
- 有以下至少一个方向的项目经验: - 语音生成大模型(CosyVoice 2/F5 TTS等); - 语音识别与理解(FunASR/Whisper/Qwen Audio等); - 其他生成式模型相关项目(GAN/VAE/LLM/Diffusion);
- 加分项 - 有语音顶会(ICASSP/Interspeech)或更高级别会议论文。