岗位职责
- 负责视频/图片创作Agent的核心研发与应用,聚焦自动化评测能力建设,应用Prompt Engineering、SFT、RL等方法,持续优化评估模型的准确性、效率及泛化能力,并通过评估反馈闭环驱动创作Agent生成效果优化;
- 跟进业界学术界技术进展,构建与优化覆盖文本、图像、语音等多模态内容的评估框架与系统;制定高质量数据评估标准及人机对齐拟合评估策略,推动评估系统在精确度、鲁棒性与可扩展性方面达到业界领先水平;
- 深度协同业务团队,主导自动化评估方案在各业务场景的规模化落地应用;主导定制化评测数据集的开发,持续演进评测指标体系,确保自动化评估能力高效支撑各创作环节,提升内容生成质量、业务指标及创作者体验;
- 系统分析行业主流产品与自研模型在多维评估指标下的表现差异,洞察核心瓶颈与优化点,为模型的性能调优与评估体系的升级提供关键决策依据。
职位要求
- 优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 熟悉NLP、CV、ML等相关的技术,深入理解大模型或图片视频生成等相关技术栈(如RLHF、SFT、Dit/Vit/Transformer等);
- 深入理解及运用常用的语言、视觉、视频/图片生成模型评价指标等;在大模型领域,主导过大影响力的项目或论文者优先;在ACL/EMNLP/ECCV/CVPR等顶会发表论文者优先;
- 出色的问题分析和解决能力,有自主探索解决方案的能力;
- 良好的沟通协作能力,能和团队一起探索新技术,推动技术进步;优秀的心理素质与应变能力,面对困难勇于迎接挑战。