部门介绍
【 】 我们正在打造一款最懂电商的AI Agent智能应用,致力于通过大模型技术解决电商全链路问题(如智能选品、自动化竞品追踪、营销素材生成、运营数据分析等)。在这里,你将参与定义“什么是好的电商AI”,通过严谨的评测体系,让Agent从“能对话”进化为“能分析、能生成、能服务”。 【
岗位职责
】 ● 电商场景评测体系搭建: 深度参与电商Agent产品的全生命周期迭代。针对营销素材、选品分析等核心场景,构建高覆盖度、高区分度的评测集(Benchmark)。 ● 构建“金标准”数据: 负责收集和清洗真实电商数据,制定高质量的评测标准。 ● 自动化评测与Bad Case分析: 对Agent的日常版本进行评测和验收。深入挖掘“幻觉”问题,输出可驱动模型优化的深度分析报告。 ● 竞品对标分析: 开展行业主流大模型及竞品Agent的横向对比评测,挖掘在电商垂直领域的优势与短板,为产品策略(如Prompt优化、RAG检索策略)提供关键数据支撑。 ● 复杂场景攻坚: 针对多轮对话、复杂意图理解(如用户模糊询单、情绪安抚)定义新的评测维度,探索Agent在电商实战中的能力边界。
职位要求
】 ● 背景要求: 2027/28届毕业生,本科及以上学历在读,计算机、人工智能、统计学、电子商务相关专业优先。 ● 电商Sense: 对电商行业有一定了解,熟悉常见电商术语(SKU/SPU、GMV、转化率等),或有电商运营/客服相关经验者加分。 ● 技术/工具能力: ● 了解大语言模型(LLM)基本原理,对Prompt Engineering(提示词工程)有浓厚兴趣。 ● 熟练使用Excel进行数据分析,会使用Python进行简单的数据处理或脚本编写者优先。 ● 逻辑与细心: 具备极强的逻辑思维能力和“找茬”能力,能从海量对话中敏锐发现逻辑漏洞和体验问题。 ● 自驱力: 善于沟通,能主动推动研发和产品解决评测中发现的问题。 【加分项】 ● 有电商平台实习经验。 ● 不仅会评测,还能手写高质量Prompt优化模型效果。 ● 有独立搭建过AI项目。