岗位职责
- 协助搭建创作领域的多模态认知体系,结合行业知识库,理解镜头美学、剪辑节奏、叙事逻辑等要素,支持图片/视频/音乐生成模型的优化与应用;
- 参与大模型后训练相关探索(如SFT、RLHF等),通过高质量数据合成、指令设计、偏好对齐等方法,提升Agent的长推理和复杂规划能力;
- 参与Agent相关核心模块的开发与实验,包括任务编排、工具调用、多Agent协作、长期记忆和个性化能力探索。
职位要求
- 具备扎实的编程能力,熟悉数据结构与算法,有ACM/ICPC、Kaggle等竞赛经历者优先;
- 对自然语言处理、计算机视觉、多模态学习等方向有基础了解,熟悉大模型相关原理,有项目经验更佳;
- 熟悉多模态大模型(VLM)、大语言模型(LLM)相关的算法技术,在相关领域有课程项目、科研或开源实践经验,了解大模型数据构造方法、Post Training算法;
- 了解LLM架构,熟悉强化学习算法(GRPO、PPO、DPO、判别式及生成式RM)、Multi-Agent技术、Prompt/Context Engineering等工程方法,有AI Agent应用或AIGC实操经验者优先;
- 对前沿技术保持好奇心,具备快速学习能力,善于思考和创新,能够将研究与业务问题结合。 加分项:
- 有大模型或生成式AI相关实习/科研/竞赛经历;
- 在GitHub、Kaggle或ArXiv等平台有项目/作品/论文;
- 对视频剪辑、美学分析、创意生成等方向有浓厚兴趣。