岗位职责
- 参与公司核心 AI 能力建设,围绕大语言模型(LLM)、计算机视觉(CV)、多模态大模型和 Agent 设计并落地企业级应用方案;
- 负责典型 CV / 多模态任务(如图像/视频理解、OCR、文档理解、检测与识别等)的模型选型、训练、评估与优化,并推动在真实业务场景中的上线与迭代;
- 将 LLM 与视觉/多模态能力结合,设计与搭建智能 Agent 系统,包括任务拆解、工具/接口调用编排、多轮对话逻辑、简单工作流管理等,用于文档理解助手、流程自动化 Agent、多模态问答等业务场景;
- 参与从需求调研、技术方案设计、模型与 Agent 实施到上线运维的全流程,与产品、工程和业务团队紧密协作,持续优化算法效果和业务体验,为业务效率提升和决策提供智能支持。
职位要求
- 计算机、人工智能、计算机视觉、自然语言处理等相关专业硕士及以上学历;
- 熟练掌握 Python 等至少一种编程语言,具备扎实的数据结构与算法基础;
- 具备一定计算机视觉实战经验,熟悉分类、检测、分割、OCR、文档理解等常见任务,以及 PyTorch、TensorFlow 等主流深度学习框架;
- 理解大语言模型及多模态模型的基本原理与应用方式,熟悉常见开源或商用模型生态,有相关项目实践者优先;
- 对 Agent 搭建有基本认识或实践经验之一: - 使用 LLM 进行工具/函数/API 调用,完成简单任务编排或流程自动化; - 有对话式助手、知识问答 Agent、流程机器人等相关项目经验;
- 具备良好的问题抽象能力、学习能力和团队协作能力,愿意持续跟进前沿技术并推动在业务中的落地。 加分项
- 在 CV、多模态、NLP、Agent 等相关方向有顶会/期刊论文;
- 有成熟落地项目或高质量开源项目经验,尤其是多模态或 Agent 相关;
- 有大模型微调、RAG、Agent 框架使用经验,或大规模部署、模型压缩与加速经验。