部门介绍
飞书&豆包办公任务模式致力于以 AI 重构办公生产力,推动企业与个人的工作方式从“高效协同”迈向“智能生产”。依托飞书成熟的一站式协作与管理能力,以及豆包办公任务模式领先的大模型能力,我们正在打造深度融合沟通、会议、文档、知识、创作与执行全场景的下一代 AI 办公产品,推动办公平台从传统协作工具升级为智能生产平台,为组织释放更高效、更智能、更具增长潜力的生产力价值。 日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。
- 负责豆包模型评测题库的构建与维护,包括题目生产、数据清洗、分类及质量审核;
- 根据不同业务场景和模型能力,设计评测方案、指标及标准,执行模型效果评测;
- 跟进模型迭代和主流产品模型的横向评估,对评测结果的准确性和可信度负责,分析定位模型问题,总结能力边界、典型案例及变化趋势;
- 推动数据处理、自动评分、结果统计和报告生成等评测流程自动化。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历在读,计算机、人工智能、信息管理等相关专业优先;
- 对AI和大模型有浓厚兴趣,经常使用ChatGPT、Claude、Gemini、豆包、DeepSeek等模型或AI产品;
- 具备较强的逻辑分析、信息判断和文字表达能力,能够对评测结果负责;
- 认真细致、自驱力强,能够从大量案例中发现并总结共性问题;
- 有大模型评测、AI产品或数据分析相关实习经历者优先;
- 每周可实习5天,能够连续实习3个月以上。