岗位职责
- 制定大模型能力的自动化、人工评测标准及方案,持续收集线上各环节的基础模型能力bad case,完成分类、分析及归因;
- 对接数据团队、协同算法团队,同步bad case分析结果及优化需求,持续推动各基础模型能力迭代优化,提升模型对话回复质量;
- 通过数据分析和用户反馈,跟踪不同场景下模型对话回复效果,针对性提出优化方案,持续提升用户对话体验;
- 沉淀模型评测方法、优化经验,搭建模型运营知识库,提升团队工作效率。
职位要求
- 本科及以上学历,计算机、人工智能等相关专业优先;
- 具有大模型运营、文本大模型评测、AI模型优化相关经验者优先;熟悉大模型评测体系、了解大模型底层逻辑者优先;
- 具备创新思维和用户导向,敏锐洞察新兴热点及用户需求;
- 熟悉大模型技术和AI产品的市场应用,具备良好的数据分析能力和市场敏感度;
- 对用户体验有高度敏感性,注重细节,追求卓越的产品品质和用户满意度;
- 具有出色的沟通表达能力和团队协作能力,能够有效协调各方资源,推动项目进展;
- 符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。