部门介绍
Data-语音团队致力于语音、音乐等大模型AIGC技术的研发和产品创新,我们的使命是通过多模态AIGC音频技术赋能内容创作和语音交互,让内容生产、消费与互动变得更加简单、沉浸、多元化。当前团队已有成熟的大模型语音合成、语音理解、音乐生成等多模态音频技术,并持续迭代大模型端到端语音交互方案等,一方面通过中台形式服务于公司众多业务线,例如豆包/Dola、抖音/TikTok、剪映/CapCut、番茄小说、海绵音乐等产品;另一方面,团队已经通过字节跳动旗下的火山引擎开放平台-语音技术和火山方舟平台,向众多企业开放技术成熟稳定的能力和服务。
- 负责公司内的音频、音乐后处理算法,解决公司内音频生成模型的落地问题;
- 研发语音/音乐信号处理的数字效果器、智能混音/母带、自适应音频等;
- 通过跟踪和创新,确保算法方面的行业领先,解决各个业务场景下的问题包括短视频、有声书、音乐创作等等;
- 持续关注学术界和行业的最新研究动态,参与国际会议、研讨会,与全球顶级团队进行交流合作。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 2027届获得硕士及以上学位,计算机科学、人工智能、语音处理、机器学习等专业优先;
- 熟练使用深度学习、神经网络以及相关的开源工具和框架(如TensorFlow、PyTorch),理解Diffusion、Transformer等模块;
- 有丰富的数字信号处理经验,音频、音乐处理相关算法和研发的项目经历;
- 具备出色的编程能力,熟练掌握Python或其他相关编程语言;
- 在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech,DAFX)。