岗位职责
- 参与音视频多模态训练数据的质量评测体系建设,协助设计评测方案与指标,输出基础数据质量分析报告;
- 参与自动化数据评测工具的开发与维护,探索自动化评估方案,提升日常评测效率;
- 配合完成音视频预训练、微调数据的效果核验,结合模型表现辅助验证数据质量;
- 追踪多模态评测领域前沿进展,学习新型评测方法,辅助优化评测维度。
职位要求
- 2028 届及以后本科及以上学历在读,计算机、人工智能、信号处理等相关专业优先;
- 掌握 Python 编程语言,具备基础工程能力,了解 WER、MOS 等音视频常用评测指标优先;
- 具备基础的逻辑分析与数据思维,有自主探索解决问题的意识;
- 对多模态大模型数据领域有热情,工作积极主动,具备良好的团队协作能力。 加分项
- 有语音、多模态相关项目或科研经验,接触过 ASR/TTS、多模态数据处理者优先;
- 熟悉 Whisper、AudioSet 等主流开源音视频工具或数据集者优先;
- 有算法竞赛、学术论文或专利相关经历者优先。