岗位职责
- 负责视频创作Agent相关的研发与应用,研究大模型的对齐方法、Agent的设计&端到端训练(Agentic RL)等,跟进LLM、Agent的最新进展;
- 研究LLM/VLM Agent训练算法,尤其是强化学习(RL)的各类算法;
- 高质量数据的挖掘和清洗,研究探索数据自动、半自动合成方案,设计视频创作Agent的评测方法,设计置信的RL Reward方案;
- 持续跟踪LLM/VLM、Agent领域的最新技术动态,并将其应用于实际业务场景中,推动技术落地。
职位要求
- 优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 深入理解大模型或图片视频生成等相关技术栈(如RLHF、SFT、Dit/Vit/Transformer、Stable Diffusion等),对强化学习(RL)在上述技术栈中的应用机制和潜力有清晰认知,可灵活运用RL优化相关流程;
- 在大模型领域,主导过有影响力的项目或论文者优先;在NeurIPS/ICML/ICLR/ACL/EMNLP等顶会发表论文者优先;
- 有大模型训练经验,有文案生成、创意生成、素材编辑、AI特效等有相关经验,有Agent、Tool-Use、MCP等相关经验优先;
- 出色的问题分析和解决能力,有自主探索解决方案的能力;
- 良好的沟通协作能力,能和团队一起探索新技术,推动技术进步。