岗位职责
- 音乐生成技术研发:负责端到端音乐生成算法设计与实现,包括旋律 / 和声 / 编曲生成、风格迁移、可控生成(节奏 / 情绪 / 乐器定制)等方向,探索 Transformer、Diffusion 等生成模型在音乐场景的优化应用;
- 模型优化与落地:负责音乐生成模型的训练、调优、压缩与部署,平衡生成质量、推理速度与资源消耗,保障产品在多终端的稳定运行;
- 音频理解与分析:研发音乐内容解析算法,实现曲风分类、情感识别、和弦 / 节拍提取、乐谱转写、歌词对齐等功能,构建高精度音乐信息检索系统;
- 多模态融合创新:探索文本 / 语音 / 图像到音乐的跨模态生成技术,开发 “文字描述生成音乐”“语音旋律提取” 等创新功能,打造沉浸式交互体验;
职位要求
- 音乐信息检索、信号处理、人工智能或相关专业的硕士及以上学历;
- 熟悉音乐生成领域主流模型(如 MusicGen、Riffusion、Jukebox)的架构与优化思路,具备模型改进或二次开发经验者优先;
- 具备音乐理论基础,理解旋律、和声、节奏、曲式等核心概念,能与音乐制作团队高效沟通者优先(非硬性要求,但加分显著);
- 熟练使用Python和C++,并至少掌握一种主流深度学习框架。 加分项:
- 有成功落地的 AI 音乐产品或开源项目经验(如参与开发过 AI 作曲工具、智能配乐软件等);
- 在顶会(ICASSP/Interspeech/NeurIPS 等)发表过音乐生成、音频理解相关论文,或拥有相关专利者;
- 有大模型预训练、强化学习、模型压缩部署(如 ONNX/TensorRT 优化)经验者优先;