岗位职责
- 在业务场景下围绕基于大模型的语音识别及合成、音乐理解及生成等方向搭建核心技术,支撑平台业务板块,将AI语音交互技术服务赋能产品线;
- 跟进最领先的基于大模型的语音交互/音乐生成技术,包括但不限于提出新的技术框架、改进现有的算法、持续提升相关技术指标,并撰写论文及申请专利。
职位要求
- 本科及以上学历,计算机等相关专业优先;
- 精通Tensorflow,Pytorch等工具,了解深度学习技术,具有模型优化经验;
- 熟悉Linux开发环境,熟练掌握C++,python,Shell等编程语言,对数据结构与算法有深刻理解者优先;
- 在相关国际会议或期刊(ICASSP、INTERSPEECH、ISMIR、 ASRU、 TASLP、 Speech Communication)发表过论文者优先;
- 较强的自驱力,有冲劲,成长诉求强烈,具备出色的沟通能力和跨部门团队协作能力。