部门介绍
【 】 我们正在打造一款最懂电商的 AI Agent 智能应用,致力于通过大模型技术解决电商全链路问题(如智能选品、自动化竞品追踪、营销素材生成、运营数据分析等)。在这里,你将参与定义“什么是好的电商 AI”,通过严谨的评测体系,让 Agent 从“能对话”进化为“能分析、能生成、能服务”。 【
岗位职责
】 ● 电商场景评测体系搭建:深度参与电商 Agent 产品的全生命周期迭代。针对营销素材、选品分析等核心场景,构建高覆盖度、高区分度的评测集(Benchmark)。 ● 构建“金标准”数据:负责收集和清洗真实电商数据,制定高质量的评测标准。 ● 自动化评测与 Bad Case 分析:对 Agent 的日常版本进行评测和验收。深入挖掘“幻觉”问题,输出可驱动模型优化的深度分析报告。 ● 竞品对标分析:开展行业主流大模型及竞品 Agent 的横向对比评测,挖掘在电商垂直领域的优势与短板,为产品策略(如 Prompt 优化、RAG 检索策略)提供关键数据支撑。 ● 复杂场景攻坚:针对多轮对话、复杂意图理解(如用户模糊询单、情绪安抚)定义新的评测维度,探索 Agent 在电商实战中的能力边界。
职位要求
】 ● 背景要求:2027/28 届毕业生,本科及以上学历在读,计算机、人工智能、统计学、电子商务相关专业优先。 ● 电商 Sense:对电商行业有一定了解,熟悉常见电商术语(SKU/SPU、GMV、转化率等),或有电商运营/客服相关经验者加分。 ● 技术/工具能力: ● 了解大语言模型(LLM)基本原理,对 Prompt Engineering(提示词工程)有浓厚兴趣。 ● 熟练使用 Excel 进行数据分析,会使用 Python 进行简单的数据处理或脚本编写者优先。 ● 逻辑与细心:具备极强的逻辑思维能力和“找茬”能力,能从海量对话中敏锐发现逻辑漏洞和体验问题。 ● 自驱力:善于沟通,能主动推动研发和产品解决评测中发现的问题。 【加分项】 ● 有电商平台实习经验。 ● 不仅会评测,还能手写高质量 Prompt 优化模型效果。 ● 有独立搭建过 AI 项目。