招聘中 校招

多模态理解和生成算法

蚂蚁集团

  • 北京、上海、杭州、重庆
  • 技术类

收录时间

岗位职责

岗位描述面向真实业务场景,围绕图像、视频、语音、文档等多模态内容的理解与生成,开展算法研发与能力落地。你将参与多模态理解、跨模态推理、内容生成与 AIGC 应用优化,推动相关能力在搜索推荐、内容创作、交互体验、智能体等场景中的持续迭代,提升模型效果、用户体验和业务价值。 具体职责:

  1. 围绕图像、视频、语音、文档等多模态内容,开展理解、生成、编辑与交互相关算法研发,提升模型在真实场景中的效果与可用性;
  2. 探索并优化多模态理解、跨模态对齐、视觉问答、文档理解、视频理解、图文检索、内容生成与编辑等关键能力;
  3. 结合大模型、AIGC、多模态学习与 Agent 技术,推动多模态能力在业务场景中的落地,包括内容生产、智能审核、交互式生成、创意优化等方向;
  4. 建设多模态数据与评测体系,覆盖数据采集、清洗、对齐、标注、增强、难例挖掘与效果分析,持续优化模型训练与迭代效率;
  5. 参与线上实验与效果分析,结合业务目标持续优化模型表现、生成质量、稳定性与成本效率。

职位要求

  1. 计算机、人工智能、数学、电子信息等相关专业优先;
  2. 熟悉计算机视觉、多模态学习及深度学习基础,理解图像/视频理解、跨模态建模、内容生成与表征学习等核心方法;
  3. 了解 Transformer、VLM、Diffusion 等主流架构,有多模态训练、生成模型或相关项目经验者优先;
  4. 具备较强的数据处理、实验设计、效果分析与问题定位能力,能够独立推动算法方案迭代;
  5. 熟练掌握 Python 与 PyTorch,具备良好的算法实现与工程落地能力;
  6. 有多模态项目、竞赛、论文复现或实际业务落地经验者优先。 加分项:
  7. 有图像/视频生成、AIGC、可控生成、交互式编辑等方向实践经验;
  8. 有多模态搜索、视觉问答、OCR/文档理解、视频理解等落地经验;
  9. 有顶会论文、开源贡献、竞赛奖项或高质量项目成果。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

蚂蚁集团多模态理解和生成算法

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看多模态理解和生成算法正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位多模态理解和生成算法蚂蚁集团 · 北京、上海、杭州、重庆

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏多模态理解和生成算法正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

蚂蚁集团多模态理解和生成算法校招 · 北京、上海、杭州、重庆

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入多模态理解和生成算法内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。