招聘中 实习

日常实习生-音频与多模态知识产权安全算法

阿里巴巴

  • 杭州
  • 技术类

收录时间

岗位职责

  1. 参与音频与多模态知识产权安全算法的设计与建设,覆盖歌曲识别、旋律检索、歌手身份验证、声音克隆与 AI 翻唱检测等方向。
  2. 参与歌声分离、音频指纹、音频表征学习、旋律建模、speaker/singer embedding、合成音频检测等模型的复现、训练和优化。
  3. 参与音频—文本—图像—视频联合建模,探索跨模态检索、音视频一致性、人物与声音一致性及内容溯源能力。
  4. 建设高质量训练与评测数据,设计变速、变调、翻唱、重编曲、压缩、噪声、多人声和 AIGC 生成等对抗/增强样本。
  5. 建立离线评测、阈值校准和误例分析体系,将模型指标转化为可解释、可落地的业务工作点。
  6. 跟踪音频生成、音乐信息检索、语音深度伪造、多模态理解和内容安全方向的前沿研究,推动论文方法在真实场景中的验证。

职位要求

  1. 硕士及以上学历在读,计算机、人工智能、电子信息、信号处理、声学、音乐信息检索等相关专业优先;特别优秀的本科生亦可。
  2. 具备扎实的深度学习基础,熟悉 PyTorch,能够独立完成论文阅读、代码复现、训练调试和实验分析。
  3. 熟悉数字信号处理、时频分析、STFT/Mel 频谱、音频特征、采样率和常见音频编码中的至少一部分。
  4. 熟悉以下一个或多个方向:音频分类与检索、音乐信息检索、源分离、ASR、speaker verification、singing voice、audio deepfake、音频生成、多模态大模型。
  5. 熟练使用 Python,具有良好的工程实现、数据处理和代码规范意识。
  6. 具备较强的问题拆解、实验设计和数据敏感度,对 AIGC、音频知识产权保护和内容安全有浓厚兴趣,能够持续、独立推进课题。 加分项:
  7. 在 ICASSP、INTERSPEECH、ISMIR、ACM MM、NeurIPS、ICML、ICLR、AAAI 等会议或期刊发表过相关论文。
  8. 有音乐源分离、旋律提取、音频指纹、歌手识别、音频生成/检测或跨模态检索项目经验。
  9. 熟悉 BS-RoFormer、WavLM、AudioMAE 等模型或相关开源生态。
  10. 具备音乐理论、乐器演奏、编曲或音频制作经验,能够理解调性、节拍、和声、旋律和音色等概念。
  11. 有大规模向量检索、难负样本挖掘、模型部署或评测平台开发经验。
  12. 实习时间至少3个月,每周至少到岗 4 天优先。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

阿里巴巴日常实习生-音频与多模态知识产权安全算法

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看日常实习生-音频与多模态知识产权安全算法正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位日常实习生-音频与多模态知识产权安全算法阿里巴巴 · 杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏日常实习生-音频与多模态知识产权安全算法正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

阿里巴巴日常实习生-音频与多模态知识产权安全算法实习 · 杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入日常实习生-音频与多模态知识产权安全算法内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。