部门介绍
AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 负责大模型训练数据的全生命周期运营管理,包括数据需求梳理、生产排期、进度跟踪与交付验收,确保数据按时高质量交付;
- 搭建和维护数据质量评估体系,制定数据质量标准与抽检规则,执行数据质量监控、问题归因与整改跟踪;协调标注团队与算法团队,推动数据标注规范落地,优化标注流程与工具配置,持续提升标注效率与数据质量;
- 基于数据生产指标、质量数据与交付数据进行多维度分析,输出运营报表与改进建议,支撑数据策略迭代与资源调配,参与数据标注平台、质检工具与运营看板的需求设计与流程优化,推动数据运营自动化、标准化与可观测化建设;
- 沉淀数据运营方法论、SOP与最佳实践,建设可复用的数据运营模板与知识库,支撑大规模数据生产的持续迭代。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历在读,统计学、数学、计算机科学、信息管理、数据科学、运筹学等相关专业优先;
- 对数据运营、数据质量管理、AI大模型训练数据有浓厚兴趣,有相关实习或项目经验者优先;
- 具备良好的数据分析能力,熟练使用Excel/SQL,熟悉Python数据处理库(Pandas、NumPy等)者优先;
- 具备较强的逻辑思维、沟通协调能力和跨团队协作能力,能够高效推进多线程任务并对齐多方诉求;
- 工作细致、责任心强,具备良好的文档撰写能力和流程化思维,善于从数据中发现问题并推动解决。