岗位职责
研究方向
- 独立或带领团队开展语音合成(TTS)相关领域的前沿技术研究,包括跨语种 TTS、高表现力 TTS、多语言扩展等方向,制定研究方案与技术路线,推动技术创新与突破。
- 负责相关算法的设计、开发、优化与验证,搭建实验环境,进行模型训练、性能评估与迭代改进,确保技术指标达到项目要求。
- 跟踪国内外语音合成领域的最新研究成果与技术动态,参与学术交流与技术研讨,撰写高质量的学术论文(如顶会 / 顶刊论文)、专利申请文件及技术报告。
- 与工程团队、产品团队紧密协作,推动研究成果的工程化落地与产品化应用,解决技术转化过程中的关键问题,保障项目顺利推进。
- 参与博士后团队的建设与管理,指导初级研究人员开展工作,分享技术经验与研究方法,营造良好的科研氛围。
职位要求
- 获得计算机、人工智能等相关专业博士学位不超过三年(含应届博士毕业生)。
- 拥有扎实的人工智能、机器学习、深度学习理论基础,熟悉常见的深度学习框架(如 TensorFlow、PyTorch、MindSpore 等),具备独立进行模型开发与训练的能力。
- 熟悉语音合成(TTS)的基本原理与技术流程,包括但不限于端到端 TTS(如 Tacotron、VITS 等)、语音编码、声码器、文本分析等模块,对跨语种 TTS、情感 TTS、语音转换(VC)、音色克隆等相关算法有深入理解。
- 具备较强的编程能力,熟练掌握 Python/C++ 等编程语言,熟悉数据处理、信号处理相关工具(如 NumPy、SciPy、Librosa 等),能够独立处理语音数据与构建实验系统。
- 有语音合成、跨语种处理、情感语音生成、语音转换等相关领域的项目研发或落地经验者优先,能够清晰阐述项目背景、技术方案、个人贡献及项目成果。
- 有较好的学术成果者优先,如以第一作者身份在语音、人工智能领域的顶级会议或顶级期刊发表过论文,或拥有相关技术专利者。