已下线 社招

千问事业部-大模型语料数据研发专家-杭州/北京

千问

  • 北京、杭州
  • 技术类-开发

收录时间

已下线 · 历史岗位确认下线时间:。以下为收录时的信息,不代表当前仍可申请。查看历史岗位档案

岗位职责

  1. 负责语料数据工程架构建设,覆盖文本、图片、音视频等多模语料的清洗、处理与交付,支撑千问app toC业务场景的高质量语料供给;
  2. 基于模型训练要求和各模态语料特性,设计标准化的数据处理算子和pipeline,与基础调度及AI Infra团队协同,实现大规模语料数据处理的效率提升和成本优化;
  3. 构建语料数据管控、数据画像与数据资产管理能力,对语料数据的来源、结构、分布、质量、覆盖度及使用效果进行系统化刻画,实现可管理、可理解、可追溯,为模型训练与业务优化提供数据洞察与决策支持;
  4. 打造语料数据质量评估平台,支持多模态语料数据质量分析,沉淀高质量数据资产,并通过AI能力提升语料生产效率与质量;
  5. 构建语料数据分析与效果归因能力,打通“语料数据—模型训练—业务效果”的反馈链路,通过数据分析识别关键问题与数据缺口,指导采集、合成、处理与标注策略,形成持续优化的数据飞轮。
  6. 构建数据Agent能力,覆盖数据处理、问题排查、指标分析、效果归因等各环节,提升模型语料数据建设的效率与效果。

职位要求

  1. 具备大规模数据处理经验,熟悉网页、文档、文本、图片及音视频等多模态语料数据处理技术,对语料清洗、去重、过滤、结构化、对齐及质量评估等关键流程有深入理解;
  2. 熟悉分布式数据计算与存储技术,如 Ray、Spark、Flink、Paimon 等,具备大规模数据处理系统设计与性能优化经验,能够与AI Infra及基础数据平台团队协同推进能力落地;
  3. 熟悉数据分类与质量评价体系,具备语料数据治理与数据画像建设经验,能够通过数据分析与评估指导语料数据建设与优化;
  4. 熟悉主流Agent开发框架,如LangChain、OpenClaw等,能基于业务场景拆解和落地skill能力建设,具有Agent实际落地经验。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

千问千问事业部-大模型语料数据研发专家-杭州/北京

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看千问事业部-大模型语料数据研发专家-杭州/北京正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏历史岗位,保留参考信息

当前岗位千问事业部-大模型语料数据研发专家-杭州/北京千问 · 北京、杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏历史岗位此岗位已经下线,收藏仅用于保存历史参考。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码查看并收藏历史岗位,不代表当前仍可申请。

微信扫码在职先机小程序收藏千问事业部-大模型语料数据研发专家-杭州/北京正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

千问千问事业部-大模型语料数据研发专家-杭州/北京社招 · 北京、杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入千问事业部-大模型语料数据研发专家-杭州/北京内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。