招聘中 社招

蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员

蚂蚁集团

  • 北京、上海、杭州
  • 技术类-算法

收录时间

岗位职责

  1. 构建百亿-千亿级参数大模型的工业化数据管道原型系统,主导预训练数据(多语言/多模态)的数据质量治理体系设计,开发数据去噪、清洗、打标、去偏和毒性检测算法
  2. 构建大模型多维度评估体系:开发面向领域任务的细粒度评估框架,设计红蓝军对抗性测试集,在细粒度层面建立能力-数据关联分析模型
  3. 构建大模型Agent应用场景的交互数据闭环系统,开发自动化数据标注、推理轨迹数据监督和治理、幻觉检测和消除等技术模块
  4. 研究预训练和后训练的数据智能新架构、新流程和新算法,包括但不限于小样本数据蒸馏、课程学习策略优化、数据价值量化评估等,并实现先进方法的工程化落地
  5. 研究基于LLM的合成数据生成框架,探索多模态数据合成(代码/数学推理/跨模态对齐)方法,探索多模态思维链合成增强、对抗性和合作性数据增强等技术路线

职位要求

  1. 海内外高校计算机科学、人工智能、数据科学、数学等相关专业毕业。
  2. 技术栈: • 精通Python编程,具备扎实的算法、数据结构和机器学习基础。 • 精通深度学习和大模型框架(如PyTorch、Huggingface transformer、LangChain、vLLM、DeepSpeed、Megatron-LM等)。 • 精通大模型的基本原理、训练和评估流程。
  3. 项目经验(满足2项+优先): • 主导过亿级token量级的大模型预训练数据清洗项目 • 在NeurIPS/ICLR/ICML/ACL等顶会发表过大模型数据侧算法的相关论文 • 开发过企业级LLM数据治理工具 • 具有复杂Agent系统的决策数据优化经验
  4. 论文阅读与实现能力:能够快速阅读和理解顶级会议(如NeurIPS、ICLR、ICML、ACL等)的论文,并复现算法。
  5. 团队合作:良好的沟通能力和团队协作精神,能够与团队成员高效合作。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

蚂蚁集团蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员蚂蚁集团 · 北京、上海、杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

蚂蚁集团蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员社招 · 北京、上海、杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入蚂蚁集团-蚂蚁技术研究院-大模型数据算法研究员内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。