部门介绍
Data-语音团队致力于语音、音乐等大模型AIGC技术的研发和产品创新,我们的使命是通过多模态AIGC音频技术赋能内容创作和语音交互,让内容生产、消费与互动变得更加简单、沉浸、多元化。当前团队已有成熟的大模型语音合成、语音理解、音乐生成等多模态音频技术,并持续迭代大模型端到端语音交互方案等,一方面通过中台形式服务于公司众多业务线,例如豆包/Dola、抖音/TikTok、剪映/CapCut、番茄小说、海绵音乐等产品;另一方面,团队已经通过字节跳动旗下的火山引擎开放平台-语音技术和火山方舟平台,向众多企业开放技术成熟稳定的能力和服务。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 结合印尼语、葡萄牙语语音学知识,完善发音规则、韵律模型和评测标准,为算法团队提供语言学支撑;
- 调研目标语种市场的配音风格、流行文化趋势和本地用户偏好,支持国际化产品的本地化适配;
- 负责相关语种录音、标注数据的质量监控与验收,保障AI训练数据质量;
- 对印尼语、葡萄牙语语音效果进行评测,向算法团队输出优化建议,持续提升语音自然度和表现力。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历在读,印尼语/葡萄牙语、语言学或相关专业优先;
- 具备扎实的印尼语或葡萄牙语能力,能从专业角度描述语言规则、语音和表达特征;
- 对语音有较好的感知力,能够分辨音素差异,感知音高、重音和韵律变化;
- 对语言、语音、AI或国际化业务有兴趣,具备良好的学习能力和沟通协作能力。 加分项
- 系统学习过语音学、音系学等相关课程;
- 接触过语料库建设、语音标注、数据处理等言语工程相关项目;
- 有Python或其他编程基础;
- 熟悉印尼或葡语国家/地区的流行文化、内容生态和用户表达习惯。