招聘中 实习

研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究

蚂蚁集团

  • 北京、杭州
  • 技术类

收录时间

岗位职责

研究领域: 大模型 项目简介: 着金融交易复杂度和全球化程度的不断提升,洗钱行为日益隐蔽化、智能化,传统基于规则和统计模型的风险识别方法面临三大核心挑战:

  1. 已知风险识别效率低:大量告警为误报,人工复核成本高;
  2. 未知风险发现能力弱:现有系统难以主动挖掘新型、模式演化型洗钱路径;
  3. 风险报告撰写标准化不足:报告内容质量依赖分析师经验,存在主观性强、逻辑不一致、信息遗漏等问题。 近年来,大语言模型(Large Language Models, LLMs)在自然语言理解与生成方面展现出强大潜力,但其在高风险决策场景中仍面临可解释性差、推理稳定性不足、缺乏目标导向优化机制等问题。与此同时,强化学习(Reinforcement Learning, RL)提供了一种通过反馈不断优化策略的框架,特别适合用于构建具备持续进化能力的智能决策系统。 然而,在风控领域,如何设计有效的奖励函数(Reward Function)以引导 LLM 做出准确、合规且具有洞察力的风险判断,仍是关键难题。当前主流做法多依赖人工标注或简单规则打分,缺乏对“风险深度挖掘”与“探索-利用权衡”的建模能力。 此外,信息熵(Entropy)作为衡量不确定性的数学工具,在异常检测与主动探索中具有天然优势,但在金融风控中尚未被充分应用于指导模型对潜在未知风险的自主发现。 因此,亟需一个融合规则与模型双驱动奖励机制、引入熵驱动探索策略、并构建端到端反洗钱智能体(Agent)架构的前沿研究项目,推动AI在金融合规领域的可信落地。

职位要求

研究领域: -目前正在攻读计算机科学或相关STEM领域的学士,硕士或博士学位 -具有一种或多种通用编程语言的经验,包括但不限于: Java,C/C ++ 、Python、JavaScript或Go -具有上述研究领域的相关经验,包括行业经验或作为参与实验室研究 优先录用: -对技术研究充满热情,具有产生新思想和创新的能力; 在自学,问题分析和解决方面表现出色 -在国际会议上或核心期刊发表一份或多份出版物或论文 -至少3个月的全职工作

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

蚂蚁集团研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究蚂蚁集团 · 北京、杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

蚂蚁集团研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究实习 · 北京、杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入研究型实习生-基于强化学习与熵驱动探索的大语言模型反洗钱智能系统研究内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。