16.3% 对 11.6%:我们如何衡量 AI 智能体是否真的卖得更多
ZAVORA 如何将其 WhatsApp 销售智能体与被它取代的规则机器人对比:相同的对话,清晰的基准,样本局限与数字并列公布。
每家 AI 初创公司都说自己的智能体更好。在 ZAVORA,我们想要一个能在挑剔的客户面前站得住的数字,并且连同它的局限一起公布。这是我们的衡量方式,以及这个数字意味着什么、不意味着什么。
16.3%成交率 · AI 智能体
11.6%成交率 · 规则机器人
击败真实基准,而非稻草人
这场对比不是“AI 对比空白”,而是我们的智能体对比它所取代的规则机器人——许多 WhatsApp 商家早已在用的菜单和关键词。一个数字,只有放在客户真正拥有的最佳替代方案旁边,才有意义。
相同的对话,相同的商品目录
2026 年 8 月,我们让同一组对话分别跑过两个引擎,各 86 轮,使用同一份商品目录。相同的问题,相同的商品,相同的价格。唯一变化的,是作答的引擎。
- AI 智能体在 16.3% 的情况下成交。规则机器人为 11.6%。相对而言,约多出 40%。
- 智能体给出有用推荐的比例为 73%,机器人为 43%。
把局限与数字一同公布
这是大多数公司略去的部分。这是一次受控测试,不是市场研究。每个引擎 86 轮,足以看出明显差异,却不足以向任何具体商家承诺具体的提升。因此,ZAVORA 的公开指南正是这样写的,就在数字旁边,并注明测量日期。
炒作会过期。信誉会复利。
一个承认自己不知道的智能体
智能体卖得更多,部分原因在于它不编造。当某个商品或价格不在目录中时,它会直说并询问。规则机器人会默默失败;粗心的 AI 会自信地失败。两者都无法成交。我们还在自己的内容流程中加入了一道检查,阻止发布任何产品实际不具备的能力。
我想对每位创始人说
- 选真实的替代方案作为基准,而不是最容易击败的那个。
- 除了你要测试的变量,其余一切保持不变。
- 把日期和局限放在数字旁边。你想要的客户会因此更信任你。
ZAVORA 由 Camilo Abella 和我联合创立。Camilo 负责产品与对话智能体;我负责集成与平台。测量及其局限发布于 ZAVORA 的指南(西班牙语)。