这一页是 AIBUY 测量 AI 购物助手的完整规则。每个公开数字都能追溯到提示词、日期、模型版本和留痕回答。方法变更时,版本号变更——旧报告保留原版本标注,绝不静默重算。
每个品类一套结构化的 100+ 条购买意图提示词,按真实买家问 AI 的口吻写,不按广告文案的口吻写。完整提示词集随公开报告与客户交付物一并交付。
每条提示词发给该市场清单里的每个助手:每次全新会话、逐字记录回答并附时间戳与模型版本。
回答解析为品牌提及、位次、所述参数与价格。打分规则固定,对清单里每个品牌用同一把尺子,不接受「模型印象分」。
人工抽样复对自动打分结果;所有进入标题的数字逐个人工核对。发现不一致时,修的是规则,不是数据。
图表与初稿按固定编辑标准产出;结论与观点由人写。每份报告开头附验证卡,写明哪些部分经过了人工核对。
一次定义,处处使用。四个指标都按「品牌 × 助手 × 测试窗口」计算。
| 指标 | 回答的问题 | 定义 |
|---|---|---|
| 提及率 | AI 到底提不提你? | 品牌出现在回答中的提示词占比;另报「前三提及率」。 |
| 推荐位次 | AI 多早提到你? | 有序清单中品牌首次被提及的平均位次(1 = 第一个被推荐),越低越好。 |
| 信息准确度 | AI 有没有说错你? | 所述事实(价格、关键参数、在售状态)与商家现行官方数据一致的比例。错误逐条留痕。 |
| 竞品压制比 | 谁赢走了你的问题? | 在提及你的提示词中,具名竞品出现在你之前的频率。以倍数报出(如 2.4×)。 |
中国市场清单覆盖前五个;美国市场清单覆盖后四个。跨市场项目用同一组提示词问两边。清单每季度复审一次。
每次运行完整归档:提示词、逐字原始回答、助手身份、模型版本、时间戳与打分输出。公开报告链接到日志节选;完整证据档案由我们掌控,不整体对外发布。
AI 助手会个性化、做 A/B、说变就变——我们的数字是对移动靶的结构化抽样,不是普查。所有地方标明样本量与日期,不抹平周间波动,也绝不从提及数据外推 GMV 影响。
方法论 v1.0(本页)管辖 2026 年 Q3–Q4 全部报告。实质性变更升版本号并在本页留日期。历史报告绝不静默重算——若重跑,新旧两版并列展示。