招聘中 社招

多模态理解与生成统一架构核心研究员-【可灵AI】

快手

  • 北京、深圳
  • 算法类

收录时间

岗位职责

现在在做什么:

  1. 理解生成一体化架构升级,同时打通图视频统一底座;
  2. 理解能力正在成为生成质量的天花板。Google Nano Banana
  3. GPT Image
  4. 0 都在朝这个方向收敛。我们的下一代模型需要在多模态理解上有完整 hands-on 经验的人,一起定义新架构——而不是执行已定方案。 你将主导:
  5. 理解生成一体化架构设计;
  6. Thinking / Chain-of-Thought for Image Generation;
  7. Long Visual Context Compression;
  8. 大规模多模态预训练;
  9. 后训练与对齐;
  10. 图视频统一探索。 我们能提供:
  11. 真正的架构话语权——你的判断直接写进技术路线图;
  12. 经过验证的执行力和产品力——O1 和
  13. 0 Omni 不是 paper,是每天上百万用户在用的产品;
  14. 充足资源——中心级千卡算力 + 完整数据基础设施;
  15. 图视频协同的独特 scope——国内少数同时在图像和视频头部的平台。

职位要求

必备:

  1. 2-3 年大规模多模态理解/生成模型 hands-on 经验,主导过完整项目或者核心贡献者;
  2. 深入理解 MLLM / Diffusion:视觉 encoder、跨模态对齐、长 context、多图交互;
  3. 有大规模多模态预训练经验(数据配比、训练稳定性、loss 平衡);
  4. 后训练全链路至少亲手做过两个阶段;
  5. 博士 or 顶会一作 or 业界核心项目主导者。 我们更看重:
  6. 对"理解生成如何深度一体化"有自己的技术判断;
  7. 深入研究或做过 Transfusion / Janus / BAGEL / MetaQuery 等统一架构;
  8. 有大规模弱关联数据挖掘和预训练经验。 加分: Visual Tokenizer / Compressor、Chain-of-Thought、视频理解或生成、开源影响力。

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

快手多模态理解与生成统一架构核心研究员-【可灵AI】

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看多模态理解与生成统一架构核心研究员-【可灵AI】正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位多模态理解与生成统一架构核心研究员-【可灵AI】快手 · 北京、深圳

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏多模态理解与生成统一架构核心研究员-【可灵AI】正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

快手多模态理解与生成统一架构核心研究员-【可灵AI】社招 · 北京、深圳

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入多模态理解与生成统一架构核心研究员-【可灵AI】内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。