岗位职责
- 大模型应用能力建设:飞书文档、表格、PPT等办公场景下的大模型应用能力建设,包括文档生成、内容改写、表格分析、PPT创作、Agent工具调用等方向;
- Office Agent链路优化:基于大模型的办公自动化Agent研发,包括探索通过Python、工具调用、结构化编辑、代码执行、Agentic SFT、Agentic RL等方式提升文档、表格、PPT任务的完成质量与稳定性;
- 数据与评测体系建设: 1)办公场景训练与评测数据的构造,包括任务定义、样本清洗、标注规范设计、负面案例分析、数据增强等工作; 2)构建面向文档、表格、PPT等场景的评测体系,包括自动化评测、人工评测、回归集建设、指标设计与效果分析,推动模型能力可验证、可回归;
- 业务场景落地:与产品、工程、设计、运营等团队协作,理解真实用户需求,需求分析、方案设计、实验验证和线上效果跟踪,推动大模型能力在飞书办公场景中落地;
- 前沿技术探索与工程实践:跟进大模型、Agent、RAG、Prompt Engineering、多模态理解、代码执行等相关技术,结合业务需求进行调研、实验和落地验证。
职位要求
- 硕士学位,计算机、人工智能、软件工程、数学、统计学等相关专业;
- 具备良好的编程能力,熟悉Python,了解常见数据处理、模型调用、工程开发工具;
- 具备机器学习、深度学习或自然语言处理基础,了解大模型基本原理和常见应用方式,如Prompt Engineering、RAG、Function Calling、Agent、SFT、RL、评测等;
- 对大模型应用落地有兴趣,愿意深入业务场景,能够从真实需求出发分析问题、设计方案、验证效果;具备较强的数据分析和问题定位能力,能够通过负面案例分析、评测数据、用户反馈等方式发现问题并推动改进;
- 具备良好的工程意识,关注方案的稳定性、可维护性、可验证性和可回归性;有代码执行、工具调用、自动化测试、数据流水线经验者优先;
- 具备良好的沟通协作能力,能够与产品、工程、算法等角色合作推进项目。