岗位职责
- 负责语音相关技术研究,包括声学模型、语言模型的数据准备、模型训练和解码器优化;负责语音合成或语音识别技术研发;
- 负责工程开发,包括模型服务化,海量语音数据处理,模型网络结构优化以及工程优化;
- 跟踪业界最新算法并落地实现。
职位要求
- 计算机、自动化、信号处理等相关专业硕士及以上学历;有较好的机器学习,模式识别和概率图模型等理论基础;
- 对语音合成或识别相关技术有深入理解,在声学模型,大语言模型,编解码器优化或扩散模型等方向有实践经验;
- 深度学习实践经验丰富,熟悉常用的序列识别建模和优化技术,熟悉llm,hmm,ctc,transformer等技术;
- 编程能力较好,熟悉c++,python,java等至少一种开发语言;熟悉caffe,tensorflow,pytorch,mxnet等至少一种框架;
- 自学意识好,求知欲强,在Interspeech、ICASSP、ICLR,AAAI、IJCAI、ICML等学术会议中有论文发表者优先。