部门介绍
AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 参与AI大模型应用能力评估工作,围绕垂类业务场景(如Model Spec和商业化),根据业务目标拆解评估维度,协助设计评估集、评估标准与自动评估工具;
- 参与设计和迭代自动评估Workflow,理解LLM as a Judge的基本思路,能结合规则校验、模型评分、抽样复核等方式提升评测效率,并协助完成模型选型、评估指标定义和模型效果对比分析;
- 对模型输出进行评估、复核和问题归因,识别负面案例类型,沉淀模型能力短板和优化建议;
- 结合真实业务链路构造复杂、多轮、边界型评测样本,关注模型在意图理解、信息准确性、风格一致性、任务完成度等方面的表现;
- 与产品、算法、运营、数据等团队同学协作,跟进问题定位、需求推进和结果闭环。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历在读,计算机、人工智能、数据科学、统计学、信息管理、语言学、心理学、商科等相关专业优先;
- 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会;
- 具备较强的结构化分析能力,能把抽象问题拆解成清晰的评估维度和可执行标准;
- 沟通协作能力强,能主动对齐目标、同步进展、推动问题解决,具备较强的闭环意识,能对自己负责的任务从理解需求、执行交付到结果复盘完整跟进;
- 灵活变通,面对需求或临时变化时,能快速理解背景、调整方案并推进落地。