岗位职责
- 负责图像-文本多模态数据的标注与质量检查,具体工作包括图像分类、图像文本描述、图像目标标注以及OCR文本校对等任务;
- 根据算法训练需求,参与制定和优化图像/文本标注规范,确保标注结果的一致性和准确性;
- 对标注数据进行统计分析,识别异常样本并反馈,协助团队迭代数据质量;
- 配合完成数据集的版本管理与维护,支持多模态模型训练数据准备。
职位要求
【2027年及之后毕业,保证每周到岗时间4天及3个月以上的实习期】
- 在读本科或研究生,专业不限;计算机、语言学、设计、信息管理等相关专业优先;
- 工作细致认真,责任心强,能专注处理图像+文本的多模态标注任务,对数据质量高度负责;
- 能熟练使用至少一种图像标注工具(如CVAT、LabelImg、Labelme、RectLabel等),或具备文字校对/语料标注经验;
- 具备良好的阅读理解与语言组织能力(图像描述任务),以及基本的图像观察力(分类与目标标注)。 加分项(优先录用):
- 有图像分类、图文描述、目标标注或OCR校对中的多项或全部经验;
- 参与过图文检索、视觉语言模型或自动驾驶场景的数据标注项目;