招聘中 社招

ATH事业群-语音/音视频大模型算法工程师-北京/杭州

阿里云

  • 北京、杭州

收录时间

岗位职责

  1. 语音/音视频大模型业务交付:负责 ASR/TTS/Omni 等语音及音视频多模态大模型在 ToB 商业化场景中的适配、调优与上线,围绕客户可感知的效果指标(识别准确率、合成自然度、响应延迟等)完成从评测到生产的全链路闭环。
  2. 业务问题定位与解决:深入真实业务场景,诊断模型在复杂条件下的效果退化问题(噪声、口音、领域术语、实时性约束等),设计并落地针对性优化方案。
  3. 客户需求转化:作为算法侧接口人参与客户技术对接,将业务诉求翻译为可执行的算法方案,管理效果预期与交付节奏。
  4. 数据迭代闭环:建设业务数据回流、清洗、标注、训练、评测的飞轮机制,驱动模型在垂直场景中持续进化。
  5. 工程协同:与工程团队协作完成流式推理、模型压缩、A/B 实验等能力建设,确保方案可规模化部署。

职位要求

  1. 计算机、人工智能、信号处理等相关专业硕士及以上,3 年以上语音、音视频多模态算法工程经验。
  2. 扎实的语音、音视频算法和落地经验,熟悉主流模型架构,有微调(SFT/RL)及线上效果调优的完整项目经历。
  3. 有将模型能力转化为客户可量化收益的经验,善于在效果、工程约束、交付时间之间做取舍。
  4. 扎实的工程实现能力,能独立完成从数据处理、模型训练到评测分析的全流程;熟悉主流深度学习训练框架及分布式训练方案。
  5. 优秀的跨团队沟通能力,能适应多项目并行推进的节奏。 加分项:
  6. 有 ToB 语音多模态产品(客服、外呼、会议、教育等)的算法交付经验。
  7. 有大模型后训练(RL/GRPO/DPO)或端到端多模态模型的落地经验。
  8. 有多模态音视频理解、agent相关经验(如语音、音频、视频内容的联合理解与分析、音画对齐、跨模态对齐等),熟悉多模态大模型者优先。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

阿里云ATH事业群-语音/音视频大模型算法工程师-北京/杭州

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看ATH事业群-语音/音视频大模型算法工程师-北京/杭州正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位ATH事业群-语音/音视频大模型算法工程师-北京/杭州阿里云 · 北京、杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏ATH事业群-语音/音视频大模型算法工程师-北京/杭州正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

阿里云ATH事业群-语音/音视频大模型算法工程师-北京/杭州社招 · 北京、杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入ATH事业群-语音/音视频大模型算法工程师-北京/杭州内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。