岗位职责
- 负责实时音频团队音乐基础技术,歌唱音乐等音频的实时理解与生成;
- 侧重于研发音乐生成、音乐理解、智能美声、音频生成与理解的基础算法;
- 通过跟踪和创新,确保算法方面的行业领先,服务于各个业务场景包括直播、游戏、社交、会议、数智人等等,帮助业务产生实际价值和打造业界领先的语音应用产品;
- 持续关注学术界和行业的最新研究动态,参与国际会议、研讨会,与全球顶级团队进行交流合作。
职位要求
- 获得硕士及以上学位,计算机科学、人工智能、语音处理、机器学习等专业优先;
- 至少3年在音频、音乐或相关领域的研究研发经验,熟悉Diffusion、CRN、Codec或理解模块之一;
- 熟悉深度学习、神经网络以及相关的开源工具和框架(如TensorFlow、PyTorch)、实时流式音频处理框架;
- 具备出色的编程能力,熟练掌握Python或其他相关编程语言,有C++或者Go语言开发经验者优先;
- 具备良好的团队合作精神、沟通能力、同理心以及解决问题的能力。