部门介绍
AI数据与安全团队为Seed基座模型及AI原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与Seed研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决AI前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和AI产品的一手用户。
- 深入大模型从预训练到对齐(SFT/RLHF)的全流程,理解并分析数据在每个环节对模型能力的核心影响;
- 通过对模型评测、负面案例和海量训练数据的深度分析,从数据视角定位模型缺陷,提出并推动有效的优化策略;
- 参与设计和迭代模型对齐所需的数据生产方案、数据平台工具搭建,并辅助构建、维护用于衡量模型能力的评测基准;
- 探索并实践利用大模型本身提升数据生产、标注和评测效率的前沿方法,挑战更高的数据质量与效率上限。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 计算机或相关专业,对LLM训练原理及SFT、RLHF等对齐技术有扎实的理解;
- 对数据有高度的敏感度和好奇心,享受从海量数据中抽丝剥茧、发现问题的过程,并具备出色的逻辑分析能力;
- 具备强烈的主人翁意识和自驱力,能主动发现和定义问题,并动手实践自己的想法以验证效果;
- 热衷于追踪AI前沿技术,有大模型训练、数据集构建或Benchmark评测等大模型相关工作经验;
- 具备良好的沟通协作能力和团队精神,能与算法、工程等不同角色高效协同。