岗位职责
- 负责图片生成大模型效果评估,构建科学、可量化的评测体系,支撑模型迭代优化;
- 面向B端有图片生成需求的行业场景,设计评测方案、构建评测题库,开展场景化能力评测;
- 进行模型版本迭代评估、产品对比评测、客户真实案例效果验证,输出专业评测报告,定位优化方向;
- 推动评测流程自动化与工具化,负责负面案例分析、提示词优化、效果对齐与验证工作;
- 协同算法、产品、业务团队,推动评估结果落地,提升模型在行业场景中的实用性与表现力。
职位要求
- 本科及以上学历,计算机、人工智能、设计类、艺术类、美学、游戏画面设计相关专业优先;
- 熟悉图像生成/多模态大模型评测方法,具备评测、数据分析或相关经验;
- 具备良好的视觉审美与美学判断力,对画面构图、光影、色彩、质感有较强感知力;
- 能够从行业场景与客户需求中提炼评测任务,独立设计评测集与评估维度;
- 掌握提示工程(Prompt Engineering),了解AI Agent、大模型微调等基础概念优先;
- 对AI有热情,学习能力强,能适应快速迭代的工作节奏。