效果衡量

Shopify AI 店铺助理 ROI 计算器

下载可编辑的 Shopify AI 店铺助理 ROI 计算器,学习如何估算增量毛利润,同时避免把辅助成交收入误当成因果增量。

一架天平正在比较包裹、服务铃和没有标记的价值筹码
图示:应将经过验证的价值与项目全部成本相比较,不能把活动量误当成实际影响。

核心原则:要计算 AI 店铺助理上线后真正带来的变化,而不是对话之后产生了多少收入。店铺数据充足时,应比较实验组与对照组;只计入确实省下的客服成本,再减去项目的全部成本。

顾客需要帮助来挑选商品或解决疑问,商家则还需要证据,确认这项运营投入确实创造了增量价值。

本指南适合负责建立商业论证的电商管理者、验证衡量方法的财务与分析人员,以及估算现金节省额的客服运营团队。

百思购® AI 店铺助理会利用商家的店铺信息处理销售和客服对话。但是,发生过对话、订单被归因给助理或问题得到解决,都不能证明产生了增量价值。可靠的 ROI 模型必须把活动量与实际影响分开。

请用店铺自己的数据替换表格中的每项输入。表格会分别接收实验组和对照组的转化率、扣除退货影响后的订单价值与利润率,然后计算两组每个符合条件会话的毛利润、增量差值、已核实的现金节省额、项目成本和 ROI,并通过检查项找出重复计算。

下载可编辑的 AI 店铺助理 ROI 计算器

快速开始:复制一份表格,选择店铺能够支持的最高衡量层级,用同一时期的店铺记录替换黄色单元格,并在依据结果做预算决策前逐项完成检查。

这份表格和衡量方案用于辅助决策,不承诺任何结果。

本指南包含什么

从可验证的价值来源入手

先选择能够观察并独立核实的价值来源。多数 Shopify 商家会考虑以下四类:

价值来源顾客行为商家衡量什么如何计入 ROI
转化提问、比较选项,然后购买或离开实验组与对照组购买率的差值只计算增量订单
订单价值接受相关加购商品、升级款或组合装实验组与对照组实际订单价值的差值订单经济性变化时,通过每个符合条件会话的组别利润计入
购物车挽回获得帮助后返回并完成购买与对照组相比增加的已完成订单如果已包含在转化增量中,就不要再次计算
客服产能无需人工介入即可获得答案经核实后不再支付的工时或外包服务量计入现金节省额;另行记录重新分配的产能

互动情况很有用,但本身不是价值来源。对话数、推荐点击、回答评分和转人工次数可以帮助诊断体验,却不能直接换算成金额。

Shopify 的分析字段参考定义了平均订单价值、毛利润、毛利率、商品转化率和加购率等指标。请始终使用同一套定义。计算器会分别输入实验组和对照组的每笔纳入订单在扣除退货影响后的订单价值。这是商家自行定义的规划输入,并非 Shopify AOV;应注明扣减项,并让两组采用相同口径。

ROI 的因果计算公式

最简单可靠的销售模型,是比较能够使用 AI 店铺助理的实验组与不能使用的留出对照组。下面的简化版本假设两组采用相同的退货调整后订单价值和利润率。可下载表格使用随后展示的通用方法,即按每个符合条件会话计算毛利润,因此实验组和对照组可以采用不同的订单经济参数。

建模推广中的增量订单
  = 建模的符合条件会话数
  ×(实验组转化率 - 对照组转化率)

扣除退货影响后的增量销售额
  = 增量订单
  × 每笔纳入订单通用的退货调整后订单价值

增量毛利润
  = 扣除退货影响后的增量销售额
  × 毛利率

经核实的客服成本节省额
  = 不再排班或购买的付费客服工时
  × 适用的综合小时成本或供应商小时费用

经核实的总收益
  = 增量毛利润
  + 经核实的客服成本节省额
  + 其他经独立核实的现金节省额

净收益
  = 经核实的总收益
  - AI 店铺助理项目总成本

ROI
  = 净收益
  ÷ AI 店铺助理项目总成本

估算实验期结果时,第一行应使用实验组会话数。预测全面推广效果时,应使用预计符合条件的全部会话数,并明确注明这是外推结果。不得用转化率差值乘以测试两组的总样本量,再把结果称为观察到的实验效果。

如条件允许,应在扣除折扣和预计退货后估算订单价值,不要把这项自定义输入改称 Shopify AOV。Shopify 将毛利润定义为净销售额减去商品销售成本。若履约、支付或其他订单层面的成本很重要,应改用贡献利润率,并记录所扣除的费用。

如果实验会改变订单价值、退货或商品组合,就不要分别叠加转化和订单价值收益。最好采用一项组别结果:

建模推广中的增量毛利润
  = 建模的符合条件会话数
  ×(实验组每个符合条件会话的毛利润
     - 对照组每个符合条件会话的毛利润)

毛利率适合用于快速判断方向。财务级模型则应改用贡献利润率,并准确记录包含哪些成本。

运营提示:把原始输入与结果放在一起。审核者应能修改任意假设,并立即看到结果随之更新。

辅助成交收入不等于增量收入

辅助订单是顾客与助理互动后产生的订单;增量订单则是因为店铺提供了助理才产生的订单。两者有重叠,但并不相同。

顾客询问配送后下单,可能即使没有助理也会购买;另一位顾客也可能稍后换一台设备回来下单。归因描述的是路径,对照比较才能估算因果关系。

Shopify 支持多种营销归因模型,并指出“任意点击”归因可能分配超过实际订单数量的贡献。归因销售额有助于调查,但不能安全地作为 ROI 的唯一分子。

指标回答什么问题合理用途不当用途
对话数顾客是否使用助理?评估采用率和规划产能把每次聊天都乘以 AOV
辅助订单互动后是否产生订单?分析和细分顾客旅程把全部辅助成交收入都称为增量收入
归因收入哪个触点获得了贡献?比较不同归因视图把贡献分配当成因果增量
实验组与对照组的增量助理可用时发生了什么变化?估算增量销售额忽略组间失衡或缺失数据
毛利润扣除商品成本后还剩多少价值?作为 ROI 分子把收入与毛利润列为两项收益

辅助成交收入可以保留在仪表板上,但必须正确标注:它是描述性指标,不代表因果关系。

先设置留出对照组再分配因果贡献

最可靠且实用的设计,是将符合条件的顾客随机分到两种体验之一:

  • 实验组:可以使用 AI 店铺助理。
  • 对照组:不能使用 AI 店铺助理。

应在顾客决定是否互动之前分组。把聊过天的人与没有聊过天的人相比会产生自我选择偏差,因为问题较难、购买意愿较高或购物车较复杂的人可能更愿意打开聊天。

分组应保持不变,并在运营条件允许的范围内尽量稳定价格、促销、流量构成、主题和库存,同时记录无法避免的变化。

采用意向性分析:衡量所有被分组的人,而不只是打开过助理的人。

上线前,请记录:

  • 符合条件的受众和主要结果,通常是购买率或每个符合条件会话的毛利润。
  • 护栏指标,例如退款率、取消率、转人工率、响应延迟和顾客投诉。
  • 分组方法、比例、计划时长和决策规则。
  • 可能导致测试失效的事件,例如大型促销、缺货或结账中断。

不要在第一次出现正向波动时停止测试。无法设置随机留出对照组时,可采用分阶段上线或匹配时段比较,并注明结果的因果可信度较低。

数据有限的店铺如何选择衡量层级

应根据预计符合条件的会话数和购买数选择衡量层级,而不是按“小店”或“大店”等标签判断。会话较少但复购频繁的店铺,可能比流量更高但购买率很低的店铺拥有更多可用信息。

衡量层级适用情况衡量什么可以得出什么结论
1.运营试点购买量太少,无法估算稳定的转化率差值回答准确率、未解决问题率、转人工、顾客投诉、延迟,以及实际省下的付费客服服务量体验是否足够安全、实用,值得扩大测试;不能得出增量销售 ROI
2.分阶段比较无法随机分组,但存在可比的时段、商品或市场每个符合条件会话的毛利润,以及上线前后的相同护栏指标方向性关联,并披露促销、库存、季节性和流量变化
3.随机留出对照店铺预计有足够的结果事件,可以评估预先声明的效果意向性转化率或每个符合条件会话的毛利润,并保持分组和护栏指标不变在受测人群中的因果估计,但仍受数据质量和统计不确定性影响

选择样本量前,应请分析人员使用店铺的基准购买率、足以支持决策的最小效果、期望置信度和计划分配比例进行计算。通用流量阈值无法回答这个问题。如果数据条件只足以负责任地采用第 1 层级,应记录运营价值,并在计算器中将增量收入保持为零。

计算器输入项与原始记录

尽可能使用商家自己的数据。行业平均值很难代表某个具体商品目录的经济情况。

输入项首选来源需要固定的定义
建模的符合条件会话数分组日志与推广预测实验期估算使用实验组会话;明确标注的推广预测使用预计的全部推广会话
对照组转化率留出对照订单 ÷ 留出对照会话与实验组采用相同的资格和订单规则
实验组转化率实验组订单 ÷ 实验组会话包含所有被分入实验组的人,而不只是聊天用户
对照组退货调整后订单价值Shopify 订单与财务假设商家定义的每笔纳入对照组订单价值,按已声明方式处理折扣、退款、取消、税费和配送;不要称为 Shopify AOV
实验组退货调整后订单价值Shopify 订单与财务假设对每笔纳入实验组的订单采用同一套商家定义口径
对照组毛利率或贡献利润率财务数据或商品成本记录对照人群和时段包含的成本
实验组毛利率或贡献利润率财务数据或商品成本记录对观察或预测的实验组商品组合采用相同成本定义
省下的付费客服工时排班、供应商或工单记录不再排班或购买的工时,而不是理论处理时长
综合小时成本薪酬或供应商数据工资加上适用的雇主成本和工具成本
其他经核实的现金节省额发票、人员或运营记录有独立证据证明不再发生,且未计入其他行的现金成本
项目成本发票与内部工时软件、设置、监控、内容与集成
护栏指标退货、投诉、延迟、质量检查可以推翻正向 ROI 结果的阈值

Shopify 的订单转化摘要可用于调查访问和引荐来源,但可能受到 Cookie 被屏蔽、无头店面或其他订单路径的限制,不能取代实验分组。

如果要在自建、采购或混合方案之间评估助理,请先用自建还是采购指南与 TCO 工作表确定项目成本输入,再计算 ROI。

使用可编辑的 ROI 计算器

下载 ROI 计算器,复制一份,再根据 Shopify、财务、分组、人员和供应商记录填写黄色输入单元格。初始值仅用于说明,不是行业基准、百思购® AI 店铺助理的实际结果或任何承诺;做出决策前必须替换。

  1. 设置时段和符合条件的人群。实验期估算使用实验组会话。只有明确标注为全面推广预测时,才能使用预计符合条件的全部会话。
  2. 输入各组经济参数。为对照组和实验组采用一致且由商家定义的退货调整后订单价值,再输入各组毛利率或贡献利润率。表格会直接计算对照组、实验组和增量的每个符合条件会话毛利润。
  3. 输入客服现金节省额。只计入不再排班或购买的付费工时或外包服务量。
  4. 只有经过独立核实,才能加入其他现金节省额。不要在此行填写理论产能、辅助成交收入或已在其他位置计算的价值。
  5. 输入项目全部成本。计入同一时段的软件、设置、集成、监控、内容维护和内部运营工时。
  6. 查看检查项。确认辅助成交收入、挽回的购物车和重新分配的固定薪资员工产能没有被重复计算。

表格分别列出软件与供应商订阅、内部设置与监控,以及其他项目成本。集成、承包商、外部服务、内容维护或前两行未包含的其他当期成本,应填入其他项目成本

表格会计算实验组和对照组每个符合条件会话的毛利润、增量毛利润、经核实的客服现金节省额、总收益、净收益和 ROI。输入留空不能证明成本或效果为零;依据结果做预算决策前,应先补齐重要信息。

无法开展随机实验时,也可以用同一份表格记录方向性估算。请在结果旁注明方法和限制,不要把它表述为因果 ROI。

假设示例

以下只展示计算方法:这些输入不是基准、百思购® AI 店铺助理的实际结果,也不是对其他店铺的预测。

假设某商家对 10,000 个符合条件的会话进行建模。对照组转化率为 2.0%,实验组为 2.2%。两组均采用 80 美元的退货调整后订单价值和 50% 的毛利率。对照组每个符合条件会话的毛利润为 0.80 美元,实验组为 0.88 美元。每个会话相差 0.08 美元,应用到 10,000 个会话后产生 800 美元增量毛利润。

如果人员记录还证实省下了 300 美元付费客服成本,总核实收益就是 1,100 美元。假设同期还有 600 美元软件与供应商成本、200 美元内部设置与监控成本,以及 0 美元其他项目成本,项目总成本就是 800 美元。因此净收益为 300 美元,ROI 为 37.5%(300 美元 ÷ 800 美元)。任何假设或证据状态发生变化,结论都应随之更新。

防止重复计算的六条规则

请用以下规则避免重复计算:

  1. 每笔订单只算一次。如果挽回的购物车已经包含在实验组与对照组的转化率差值中,就不要再次计入购物车挽回收入。
  2. 收入与利润二选一。增量收入是中间步骤,ROI 应使用由此产生的毛利润或贡献利润。
  3. 把转化与订单价值分开。如果测试直接估算每个符合条件会话的毛利润,就不要再额外加入独立的转化收益和订单价值收益。
  4. 不要给每次自动回答都标价。只有确实不再支付或购买的工时,才能按综合人力成本计算。重新分配的固定薪资工时属于产能;只有其产出经过独立衡量且未在其他位置计算时,才能货币化。
  5. 扣除折扣和退货。通过高额优惠促成或随后退货的销售,并不值结账时显示的金额。
  6. 不要把归因收入计入因果总额。辅助成交收入和归因收入可以解释机制,但不能叠加到实验增量上。

可以这样检查:“同一笔订单、同一个工时或同一笔金额,是否可能出现在另一行?”如果答案是肯定的,就应合并计算。

明确处理跟踪缺口

Shopify Analytics 与 Google Analytics 使用不同定义,也会受到 JavaScript、Cookie、拦截工具、时区、隐私设置和网络连接影响,因此结果可能不同。请参阅 Shopify 的差异说明,选定一个分组系统作为实验唯一可信的数据源,并用 Shopify 交易记录核对已完成订单。

记录无法衡量的符合条件流量占比,并说明结果代表哪一类人群。不得绕过同意机制,也不要向分析工具发送原始对话文本、电子邮箱地址、电话号码或其他可识别个人身份的信息;Google Analytics 禁止收集个人身份信息

可能导致结果失效的问题

完成重复计算检查后,还要排查可能让结果失去可靠性的设计和运营问题:

  • 实验组与对照组采用不同的资格、订单或利润率定义。
  • 促销、缺货、流量构成、主题变更或中断只影响一组,却没有记录失衡。
  • 第一次出现正向波动就停止测试,或只选择有利的日期和细分人群。
  • 把某个品类的利润率套用到构成明显不同的实验组商品组合。
  • 未量化分组覆盖缺口或分析定义冲突。
  • 因为财务结果为正,就忽略页面变慢、回答不佳、投诉、不安全的表述或过多转人工。

ROI 不是唯一决策标准。如果某项方案虽能提高短期毛利润,却产生不安全的表述或让客服体验变差,就不应原样上线。

每月复盘清单

首次实验结束后,请按这份运营清单复盘:

  • 按一致定义重新计算转化率和毛利润。
  • 比较实验组与对照组;条件合适时,长期保留一小部分留出对照。
  • 核对折扣、退款、取消和商品成本。
  • 用排班或供应商记录核实客服工时。
  • 检查回答准确率、转人工、延迟和投诉。
  • 检查商品目录、库存或政策变化是否影响结果。
  • 记录同意覆盖率和跟踪缺口。
  • 将内部运营工时计入项目成本。
  • 更新计算器中的假设、证据链接和分析时段。

运营提示:每月复盘应推动决策,而不只是生成图表。可以补强薄弱知识、调整护栏、扩大成功用例,或暂停高风险用例。

延伸阅读

先计算,再声称获得 ROI

先从范围明确的用例开始;数据条件允许时保留对照组。决定是否扩大用例的依据,应是毛利润和顾客结果,而不是辅助成交收入的醒目数字。

下载可编辑的 ROI 计算器

如需用自己的商品目录测试底层体验,可以了解百思购® AI 店铺助理,也可以查看当前价格。百思购® AI 店铺助理不保证特定 ROI;结果取决于店铺、商品目录、流量、利润率、实施方式和衡量设计。

其他文章

全部文章

立即体验

让导购成效更容易评估

永久免费,1 分钟上线。