岗位职责
- 研究前沿语音、语言、多模态模型在音频生产与消费场景中的应用技术;
- 负责音频AI能力的全链路工程落地,涵盖模型集成、服务化部署、性能优化等核心环节;
- 应用前沿模型,提升音频相关业务产品的质量和用户体验;
- 通过量化、剪枝、推理加速等手段对模型进行调优,满足业务场景对精度与延迟的要求;
- 面向音频业务场景建设数据集,包括数据采集、标注工具开发、数据质量分析与清洗;
- 为业务产品提供AI解决方案,包括但不限于实时流式处理、离线批量处理、AI工作流等。
职位要求
- 本科及以上学历,计算机、人工智能、自动化、信号处理、数学专业优先;
- 对大模型底层原理有基本理解,能跟踪语音、语言及多模态领域前沿技术动向;
- 扎实的编程基础,对数据结构与算法有深入了解,熟练掌握 Python/C++ 等主流语言一种或多种;
- 熟悉 PyTorch、ONNX、TensorRT、HuggingFace/transformers 等框架和库的一种或多种;
- 熟悉模型推理优化技术,如量化、剪枝、算子融合等,有实际落地经验者优先;
- 熟悉音频相关工程技术,如语音活动检测、说话人分离、音频增强等的一种或多种;
- 具备强大的工程能力,能快速将模型能力集成到线上服务,关注服务稳定性、推理性能与延迟优化;
- 有 ACM/IOI/NOI 等算法竞赛获奖经历优先;
- 责任心强,积极主动,有良好的沟通与协作能力,能主动推动业务落地。