岗位职责
- 负责保险音视频通话 Agent 的研发与应用,结合语音、多模态大模型及智能体技术,打造自然、实时、可信的保险服务体验;
- 重点研究语音交互能力,包括 ASR、TTS、语音理解、实时打断、低延迟对话及音视频多模态融合,并推动技术在保险咨询、产品讲解、客户服务等场景落地;
- 参与大模型及 Agent 的训练与优化,包括 SFT、强化学习、工具调用和对话策略优化,持续提升复杂保险任务的理解与执行能力。
职位要求
- 具备扎实的机器学习、深度学习基础和良好的工程能力,熟练掌握 Python,熟悉 PyTorch 等主流深度学习框架;
- 具备音频或语音方向的实战经验,熟悉 ASR、TTS、语音大模型、实时音视频通信中的一个或多个方向;有低延迟语音交互项目经验者优先;
- 熟悉大模型、智能体或多模态模型技术,有模型训练、SFT、强化学习、工具调用等项目经验者优先;
- 有开源项目、顶会论文,或保险、金融等行业智能应用经验者优先。