岗位职责
- 参与语音tokenizer,ASR,TTS、端到端对话、音乐等算法及新技术方案的研发,推进语音新技术的突破;
- 参与可控语音生成、语音对话、情感理解及交互等场景的算法方案设计和研发,同时负责推进整体方案的落地;
- 参与在大模型技术栈下,新业务场景、新交互形态、新算法应用的调研和探索。
职位要求
- 本科及以上学历,语音、多模态、机器学习、计算机相关专业,
- 熟悉语音识别、语音生成、语音前端、端到端对话等语音算法原理;
- 有语音交互项目的推进和落地经验,熟悉业界主流的语音系统实现方案。 加分项
- 在多模态/语音/语言大模型领域有科研或项目实践经验,在国际顶级会议/期刊发表过高质量论文;
- 大模型分布式训练、AI Infra等领域有科研或实践经历。