岗位职责
- 负责音频生成算法的研发与落地:语音美化与人声增强、变声与音色转换和多模态音频生成;
- 在音频 AIGC 与增强大模型方向开展前沿技术研究,保持算法在工业界和学术界的领先;
- 负责音频效果评测的构建与应用:音频理解基座、音频美学评价等;
职位要求
- 本科及以上学历,计算机、信号处理、声学等相关专业;
- 熟悉以下至少一个方向;Diffusion、Flow Matching、Neural Codec 等生成架构;音频多模态大模型(Qwen-Audio、CLAP、AudioMAE 等)的微调与应用;
- 有良好的沟通表达能力和团队精神,对前沿研究感兴趣,对推动前沿算法在工业界落地有热情。
- 在 Interspeech、ICASSP 等顶会发表过论文,或在 DNS 等 Challenge 取得成绩者优先; 加入我们,你会拿到什么 核心业务阵地 —— 你训练的每一个模型,都直接决定亿万用户的聆听体验 前沿与落地兼得 —— 从论文到生产,从 Diffusion 到音频大模型,全链路一站式练满 顶尖同行的成长加速度 —— 与领域内的资深专家并肩,在最难的问题上打磨自己 现在,就是加入的最好时机。在这里,与我们一起,把技术变成亿万人身边的声音。