岗位职责
- 跟进和设计基于强化学习的生成式Listwise混排框架,重点研究探索多目标reward设计、强化学习优化算法、兼顾激励相容原则等方向;
- 结合以上方向的探索和研究,撰写发表论文,和业界、学术界保持良好的交流。
职位要求
- 2028届及以后毕业,本科及以上学历在读,自然语言处理、机器学习、数据挖掘、人工智能等相关专业;
- 熟练掌握Tensorflow深度学习框架,扎实的编程基础,具备独立的算法实现能力;
- 有强化学习实操经验,参与过业界强化学习大规模项目者优先;
- 良好的逻辑分析能力和数理基础,对算法原理及应用有较深入的理解,在人工智能相关的各类国际顶级会议/期刊中发表过论文者优先 本项目为得物研究型实习生项目。该项目岗位最低实习时长为3个月,岗位非纯业务开发岗位,主要目的为发表顶级期刊。