岗位职责
- 负责情感化、长文本TTS研发,优化韵律自然度与跨句连贯性,提升语音表现力;
- 参与Voice Design技术开发,支持音色克隆、音色编辑等个性化能力;
- 探索双双工端到端S2S(语音到语音)对话技术;
- 基于CosyVoice、Seed-TTS、Whisper等开源框架进行调优与业务适配,根据需求参与ASR相关任务。
职位要求
- 计算机、信号处理等相关专业本科及以上学历;
- 有TTS或ASR任一方向的实战经验,熟悉至少一个主流语音模型(如CosyVoice、Seed-TTS、Whisper、Paraformer等);
- 能阅读论文并动手复现,有ModelScope/Hugging Face使用经验加分。