岗位职责
依托淘宝、天猫超大规模商业场景,我们致力于通过最前沿的多模态大模型技术驱动万亿级交易额的增长。在这里你将面对业界最复杂的电商图文、视频语境,与顶尖团队一起探索 AIGC 与多模态技术在搜索广告全链路(召回、排序、创意生成)的深度融合与变现。包括并不限于:
- 负责电商多模态统一表征: 构建面向海量商品、直播、短视频的超大规模预训练模型(VLM),解决多模态语义对齐、细粒度特征提取及跨模态检索难题。
- 负责生成式广告物料(AIGC): 探索 Diffusion Model、LLM 在广告创意自动生成(文案、头图、视频步进)中的应用,提升物料投放质量与点击转化率。
- 负责多模态驱动的商业决策: 将多模态感知能力深度注入广告全链路(从搜索词理解到广告 CTR/CVR 预估),实现从“看懂图片”到“理解意图”的决策升级。
- 负责全链路多物料优化: 针对商品、直播间、短视频等多类型物料,设计统一的跨模态排序算法,优化搜索场景下的多元流量分配效率。
- 负责视觉底层技术创新: 针对电商复杂场景,优化 OCR、商品检测、度量学习及视觉搜索等经典任务,建立行业领先的视觉基座。
职位要求
【必备项】
- 计算机、数学或统计学相关专业硕士及以上学历;
- 熟练掌握Java/C++/Python中至少一门语言,有扎实的数据结构和算法基础;
- 熟悉CV/多模态算法、常用的机器学习和深度学习算法;
- 具备优秀的分析和解决问题的能力,良好的沟通协作能力。 【加分项】
- 有计算机视觉、数据挖掘、机器学习、强化学习、信息检索、自然语言理解、推荐系统、计算广告学及算法博弈论相关领域研究和实践经验,在以上领域的国际会议(NeurIPS、ICML、ICLR、CVPR、ICCV、ECCV、ACM MM、SIGKDD、ACL、WSDM等)或者期刊上发表过论文者优先;
- 参加过ACM或数据挖掘&机器学习类竞赛(天池大奖赛、Kaggle)并取得好名次者优先;
- 参与过机器学习开源项目并有突出贡献者优先。