岗位职责
- 应用前沿大模型技术,提高点播业务领域的产品性能和用户体验,模型技术包含但不限于speech recognition/force alignment/punctuation prediction/speech separation等;
- 面向业务场景和点播技术领域建设智能字幕数据集,包括数据采集、支持标注工具、数据分析等;
- 为业务产品提供智能字幕解决方案,包括但不限于使用模型调优、智能体、工作流等方法。
职位要求
- 本科及以上学历,计算机、人工智能、自动化、数学专业优先,熟悉音频编码封装格式优先,熟悉字幕格式优先;
- 扎实的编程基础,对数据结构、算法有深入了解,熟练掌握Python/C++等主流语言一种或多种;
- 对语音-字幕大模型的底层原理有基本理解,具备快速学习能力,责任心强,积极主动,有良好的沟通和合作能力;
- 了解PyTorch、TensorFlow、 ONNX、huggingface、transformers等框架和库的一种或多种;
- 了解SFT、HFRL等方法及框架;
- 了解langchain/langgraph/agentscope等框架的一种或多种,了解dify/coze等低代码平台的AI应用开发。