岗位职责
- 负责豆包大语言模型/应用的评估体系设计、评估结论产出、并能够根据评估结论进行系统分析,提出有价值的改进建议,协同各方提升大语言模型能力与应用效果;
- 搭建评测体系:设计大模型能力及应用效果的评估体系,搭建评测流程和功能,保证评估结论及时准确产出;
- 评估结果分析:分析和解读评测结果,提出提升模型能力和应用体验的数据生产和产品设计策略;
- 研究评测方案:跟进和调研大模型行业最新评测研究和报告,结合实际应用场景,更新内部评测技术方案;
- 行业产品调研:及时了解和分析大语言模型业界产品和技术发展动态,辅助判断未来发展趋势。
职位要求
- 较强的分析和沟通能力,擅长从数据中发现有价值的产品改善建议,并能推动落地;
- 对大语言模型领域感兴趣,愿意投身于大语言模型/AIGC方向等领域积极探索;
- 具备较强的逻辑思维,富有创新精神,有较强的项目管理能力;
- 加分项:有大语言模型相关领域技术背景、数据分析背景、用户和市场研究经验。