招聘中 实习

智多星-大模型安全对抗工程师

阿里巴巴

  • 杭州
  • 技术类

收录时间

岗位职责

  1. 参与大模型安全对抗演练:协助开展大模型全链路(SFT/RLHF/推理部署)的安全风险排查、漏洞挖掘与红蓝对抗样本建设。
  2. 协助研发自动化红队工具:参与设计并实现针对大模型/多模态模型的自动化越狱、提示词注入和对抗性扰动生成算法,协助进行安全边界压力测试。
  3. 参与大模型安全对齐与防御算法研发:辅助进行基于RLAIF、DPO等前沿对齐技术的算法实验;参与优化输入/输出内容安全过滤模型与多维风险评估机制。
  4. 开展前沿安全威胁与防御研究:针对间接提示词注入、数据投毒、偏好劫持等前沿安全威胁进行算法复现与评测,探索前沿防御方案。
  5. 负责安全数据建设与评测闭环:协助构建和维护多维度的安全评测Benchmark,参与编写自动化评测脚本,协助实现“攻击生成-防御阻断-模型评估”的迭代闭环。

职位要求

  1. 计算机、网络安全、人工智能等相关专业在读硕士或博士,对大模型安全、AI对抗样本、密码学或传统Web安全有浓厚兴趣。
  2. 具备扎实的深度学习基础:熟练掌握PyTorch等深度学习框架,熟悉Transformer架构,有大模型微调(PEFT/SFT)或强化学习(RL)基础实验经验者优先。
  3. 对大模型安全漏洞有一定认知,了解常见的大模型安全问题(如提示词注入、越狱攻击),有关注或复现过国内外主流大模型越狱/攻击方法的经历。
  4. 具备良好的代码功底与工程实践能力:精通Python,熟悉Linux开发环境,有良好的编码习惯,对分布式训练或海量数据特征处理有一定了解。
  5. 强烈的技术好奇心与自驱力:具备优秀的快速学习能力和极客精神,乐于钻研前沿技术,有良好的团队协作和沟通能力。
  6. 在安全或人工智能顶级会议/期刊(CVPR,NeurIPS,ICLR,ACL等)发表过高水平安全对抗/AI安全方向论文,或在知名AI比赛、大模型安全挑战赛中获得优异成绩,或有大型开源AI安全项目贡献经历者优先。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

阿里巴巴智多星-大模型安全对抗工程师

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看智多星-大模型安全对抗工程师正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位智多星-大模型安全对抗工程师阿里巴巴 · 杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏智多星-大模型安全对抗工程师正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

阿里巴巴智多星-大模型安全对抗工程师实习 · 杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入智多星-大模型安全对抗工程师内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。