岗位职责
- 支持语音识别技术在字节跳动公司内外丰富的业务场景落地,解决落地过程中的前沿问题,持续优化语音识别核心技术效果;
- 搭建音频理解核心技术体系,专注语音识别的前沿技术和算法效果,追求和探索业界算法。
职位要求
- 熟悉语音识别算法,对语音识别系统落地和业务效果优化有实际经验;
- 对数据有实际处理经验,有使用海量数据优化实际业务模型的动手经验;
- 对深度学习技术有深度了解和丰富的实战经验,熟悉PyTorch、TensorFlow、Kaldi等平台,有端到端语音识别框架(Transformer、RNN-T、LAS、CTC等)的调优经验;
- 具备良好的编码能力,熟悉Linux开发环境,熟悉C++和Python语言;
- 有独立工作能力并能与团队融洽相处。 加分项:
- 在会议、智能硬件等场景有语音识别系统落地和优化经验;
- 对前沿的端到端语音识别系统有优化经验,熟悉RNN-T、Encoder-Decoder等端到端语音识别算法;
- 有优化语音识别解码器并实际落地的经验;
- 在相关国际会议或主流期刊上发表论文(ICASSP、Interspeech、ASRU、IEEE、ACM Transactions等);
- 语音相关比赛或机器学习相关比赛拿到国际领先名次、ACM、NOI、IOI、TopCoder等编程比赛获奖,参与过有影响力开源项目;
- 沟通能力好,主人翁意识强,有组织协调能力,乐观自省。