部门介绍
AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。
- 负责世界模型训练所需视频、图像数据的数据寻源工作,主动开拓并引入影视公司、视频平台、版权方、内容机构等外部数据源,建立并维护稳定的数据供给渠道;
- 基于模型训练目标与数据缺口,开展行业数据资源调研,输出目标数据源清单、合作可行性评估及引入策略,支撑数据资产的规模化扩充;
- 主导与数据供应商的商务沟通与合作推进,明确数据规格、版权合规与交付标准,把控引入进度与数据质量,独立完成从对接到交付的全流程闭环;
- 深度参与视频、图像数据生产及标注流程,基于模型能力边界输出视觉数据标注策略及标准,保障引入数据与训练目标的高效衔接;
- 沉淀数据寻源方法论与供应商管理机制,搭建可复用的资源库与评估体系,持续优化数据获取成本与效率。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 具备丰富的视频行业资源积累,熟悉影视公司、视频平台、MCN、版权代理机构等数据供给生态,拥有可直接调用的合作资源与人脉网络者优先;
- 具备优秀的调研能力与商务拓展能力,能独立完成行业信息搜集、目标公司筛选、合作可行性分析与商务谈判,有数据采买、版权合作或供应商引入经验者优先;
- 数字媒体、影视、计算机、市场营销等相关专业背景优先;具备优秀的结构化表达能力,逻辑清晰、表达严谨,拥有跨职能协作意识与快速学习能力;
- 了解大模型基础原理与数据需求逻辑(如SFT/RLHF训练范式),持续追踪AIGC及世界模型前沿进展;能主动识别数据偏差与供给缺口,并提出可落地的寻源及优化建议。