岗位职责
研究领域: 智能语音信号处理 项目简介: 当前声纹识别主要集中研究单一类型设备下识别的准确率,对多设备,跨设备的研究较少且一直存在性能挑战。不同终端设备在收音硬件、信号处理算法等方面的差异,会导致声纹特征表征不一致,进而影响识别系统的泛化能力。目前存在的主要问题包括:
- 模型普适性不足:针对不同设备往往需定制化开发专用模型,难以实现统一架构下的跨设备适配;
- 跨设备识别性能瓶颈:在设备间声学特性差异显著时,声纹特征的匹配精度明显下降。随着语音交互的普及和更多智能设备涌现,声纹识别将赋能于手机、平板、智能眼镜、车机、耳机、音响、智能家电等。同时希望声纹最终实现“一端注册,多端识别”的目标,这对多/跨设备声纹识别提出了迫切的技术需求。因此,开展“多设备跨设备声纹识别”的相关研究,具有重要的理论价值与实践意义。
职位要求
研究领域: -目前正在攻读计算机科学或相关STEM领域的学士,硕士或博士学位 -具有一种或多种通用编程语言的经验,包括但不限于: Java,C/C ++ 、Python、JavaScript或Go -具有上述研究领域的相关经验,包括行业经验或作为参与实验室研究 优先录用: -对技术研究充满热情,具有产生新思想和创新的能力; 在自学,问题分析和解决方面表现出色 -在国际会议上或核心期刊发表一份或多份出版物或论文 -至少3个月的全职工作