岗位职责
协助阿里集团安全部的风险域基座大模型-“御风大模型”的研究和设计,如果你对以下topic感兴趣,请加入我们:
- 数据-模型飞轮、合成数据、质量评估、数据配比、知识扩增等,将算法理解在数据大盘中变现
- 文本模型的持续预训练建设,包括知识注入、通能能力建设等;后训练建设,包括指令遵循、推理强化、强化学习、指令微调等
- 图文、视觉模型的预训练知识注入、生成理解统一建模、模态对齐、视觉细粒度强化、多模态对抗变异识别等建设;
- 模型训推加速与架构设计,包括但不限于MoE设计、动态神经网络、模型蒸馏、模型裁剪、架构搜索等
- 除了以上学术价值以外,前沿技术研究结果将会快速落地在日均百亿千亿并发的潜在业务场景拿到实际业务价值。
职位要求
- 计算机、数学或统计学相关专业硕士及以上学历;有一定科研训练,能独立完成研究并形成学术和技术结果;
- 熟悉大模型相关的各类技术,有一定的大模型实操落地或者研究经验;在大模型、机器学习、视觉、自然语言等顶会顶刊(CVPR、ACL、SIGKDD、ICML、NIPS、WSDM、WWW、AAAI、CIKM、SIGIR等)发表过论文者更佳;有相关技术竞赛、相关优秀开源项目者更佳;
- 在自媒体内容域、内容平台、内容安全领域有实习或者工作经验者更佳;
- 有独立工作能力并同时能与团队融洽相处,乐观自省,有一定抗压能力;
- 掌握前沿技术的脉络,追求技术本质,对前沿技术保持高涨的热情