部门介绍
AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 深度参与世界模型训练所需视频、图像的数据生产及标注全流程,基于模型能力边界与训练目标,输出视觉数据标注策略及标准,支撑图像、视频数据资产的规模化交付;
- 负责对接数据供应商及数据标注团队,明确任务需求,把控任务交付进度及质量,独立完成项目交付;设计并优化高质量多模态(文本、图像、视频、3D资产)数据集的构建流程,主导清洗、标注、SFT及RL的数据策略设计;
- 基于摄影、剪辑、绘图、3D建模或视觉设计等实操经验,完成图像、视频素材的标准化处理及标注,实现自动化数据处理链路,探索合成数据的生成策略;
- 具备一定代码能力,能够利用Python或其他编程语言实现标注辅助(如数据提取、数据质检、格式校验等),提升人工标注效率与一致性;
- 结合世界模型场景,参与Prompt策略设计与效果验证,提升模型生成结果的可控性与语义对齐度。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历在读,数字媒体、计算机、人机交互、图形学等计算机相关交叉学科专业背景优先;
- 具备优秀的视觉感知力、结构化表达能力,逻辑清晰、表达严谨,拥有跨职能协作意识与快速学习能力;熟悉摄影、视频剪辑、数字绘画、3D建模、主流游戏引擎(UE/Unity)、3D空间逻辑、物理引擎仿真,掌握至少1类主流视觉内容生产工具(如Photoshop、Premiere、Blender、Procreate等);能从创作视角理解画面构成、光影逻辑与语义层次;
- 理解大模型基础原理(如Transformer架构、SFT/RLHF训练范式),持续追踪AIGC前沿进展;具备基础编程能力(Python优先),可通过脚本辅助完成数据清洗、数据标注、格式校验等自动化任务;
- 有面向大模型训练的数据标注、描述撰写或质量校验项目经历者优先;能主动识别数据偏差(如描述模糊、细节遗漏、逻辑断裂)并提出可落地的优化建议;熟悉Prompt Engineering基本方法。