部门介绍
Data-语音团队致力于语音、音乐等大模型AIGC技术的研发和产品创新,我们的使命是通过多模态AIGC音频技术赋能内容创作和语音交互,让内容生产、消费与互动变得更加简单、沉浸、多元化。当前团队已有成熟的大模型语音合成、语音理解、音乐生成等多模态音频技术,并持续迭代大模型端到端语音交互方案等,一方面通过中台形式服务于公司众多业务线,例如豆包/Dola、抖音/TikTok、剪映/CapCut、番茄小说、海绵音乐等产品;另一方面,团队已经通过字节跳动旗下的火山引擎开放平台-语音技术和火山方舟平台,向众多企业开放技术成熟稳定的能力和服务。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 与算法团队一起搭建具有通用性和可拓展性的数据方案,跟进语音对话大语言模型训练过程中各阶段数据质量的评估;
- 设计大模型评估方案,跟进语音对话大语言模型训练过程中各阶段模型效果的评估;
- 制定产品和项目流程机制,协调项目各个角色高效工作;
- 负责项目资源的协调与组织,并与项目各方进行良好沟通,确保项目团队各干系人协同工作。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历在读,汉语言、语言学、英语、小语种、翻译、计算语言学、心理学等相关专业优先;
- 有较强的分析和沟通能力,擅长从评估数据中发现有价值的产品和模型改善建议,并能推动落地;
- 有AI数据标注及管理经历/了解模型原理或评测方案者优先;
- 具备较强的逻辑思维,富有创新精神,解决问题能力强;
- 一周可到岗五天、可长期实习者优先,工作地北京。