部门介绍
AI 数据与安全团队为 Seed 基座模型及 AI 原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与 Seed 研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决 AI 前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升。我们既是帮助模型技术迭代的一线贡献者,也是模型和 AI 产品的一手用户。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 参与语音大模型数据标注与模型评测体系的搭建(语音通话方向),负责子模块或方向的标评方案设计与落地,配合算法、产品团队推进自研探索与业务应用;
- 参与迭代数据标注与评测标准、构建评测题库,负责模型效果评测的执行与结果分析,定期产出评估报告,保障评测结论可信;
- 运用PE、代码、Agent、机器标注等手段完成数据预处理、清洗与分析,积极探索自动化数据生产、模型评估、数据合成等方法,持续提升标评效率、降低人工投入;
- 跟踪大模型技术进展与行业趋势,为产品提供语言学专业支持。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 硕士及以上学位在读,计算语言学、语言学、汉语言文学、计算机等相关专业优先;
- 可连续实习6个月以上;
- 中文语法基础扎实、语感良好、情绪感知力强、对语音敏感者优先;
- 对话AI深度用户,能敏锐识别人机交互中的对话节奏、附和、主动推进等表现,有访谈、咨询经验者加分;
- 具备一定的PE或代码能力,了解深度学习基本原理或大模型评测方案,有相关项目实践经历者优先;
- 具备良好的数据分析与沟通能力,思维活跃、耐心细致,能适应多线程的工作模式,渴望在真实业务场景中解决对话系统问题。