招聘中 校招

语音交互算法工程师

雷火事业群

  • 杭州
  • 人工智能

收录时间

岗位职责

  1. 负责语音交互与语音内容生产相关算法研发,包括语音合成、语音生成、语音克隆、音色设计、语音转换、语音识别与理解、语音大模型对齐与强化学习等方向。
  2. 面向实时互动与内容生产场景,研究语音/文本/视频/图像等多模态输入到语音的生成与控制,提升自然度、拟人度、情感表现力、音色一致性、风格可控性,以及流式低延迟、可打断的实时表现。
  3. 构建从数据采集清洗、模型训练评估、推理优化到线上服务与离线资产生产工具链的完整流程。
  4. 与音频、引擎、游戏产品团队协作,将算法能力应用到游戏 NPC 实时语音交互、角色语音、Agent 驱动的语音内容/资产生产管线和语音创新玩法中。

职位要求

  1. 计算机、人工智能、语音信号处理、电子信息或相关专业,应届硕士或博士。
  2. 扎实的机器学习/深度学习基础,熟悉生成式模型、Transformer、Diffusion、自回归建模、时序建模、多模态学习、RL 对齐等至少一个方向。
  3. 具备语音信号处理基础,理解声学特征(Mel 谱 / neural codec)、声学与语言学建模、语音前端处理(VAD / 降噪 / AEC)、流式推理,以及 MOS / WER / RTF 等评测指标。
  4. 优秀的编程能力和良好的工程习惯,熟练掌握 Python,熟悉 C++ 者优先;熟练使用 PyTorch 等至少一种主流深度学习框架。
  5. 具备良好的 AI 工程化能力,熟悉各类文本 / 多模态大模型的使用与集成,有 Agent / claw / harness 等工程实践经验者优先。
  6. 有以下至少一个方向的项目经验: 语音合成(TTS)及其情感 / 韵律 / 风格可控生成(CosyVoice 2 / F5-TTS /Fish-audio/ Voxcpm2,或豆包/MiniMax/11labs等商用语音大模型); 语音生成(音乐 / 音效 / 唱歌,如 Seed-Audio 等); 语音克隆、音色设计与语音转换; 语音识别与理解(ASR大模型、omni模型); 语音大模型对齐与强化学习(RLHF / GRPO等)。
  7. 理解语音生产与交互管线,了解数据标注、音频处理、模型训练、流式部署、线上监控等基础流程;熟悉相关开源生态与工程工具者优先。 加分项:
  8. 有实时语音交互落地、AIGC 语音内容生产或完整产品落地经验;
  9. 有 Agent / LLM 编排驱动的语音资产生产经验;
  10. 有语音顶会(ICASSP / Interspeech)或更高级别会议论文;
  11. 有高质量开源项目;
  12. 热爱游戏。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

雷火事业群语音交互算法工程师

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看语音交互算法工程师正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位语音交互算法工程师雷火事业群 · 杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏语音交互算法工程师正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

雷火事业群语音交互算法工程师校招 · 杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入语音交互算法工程师内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。