买东西这件事,正在从搜索框搬进 AI 助手。AIBUY 用同样的 100 条真实购买意图提示词去问豆包、元宝、Kimi、文心、淘宝问问和海外模型,记录每个回答、公开推荐结果——让消费者拿到证据,让商家看到差距。绝不卖排名。
二十年里商家争夺搜索排名。现在你的客户直接问 AI 助手,而助手的答案来自训练数据、第三方榜单和它能爬到的页面。如果 AI 说错了你的参数,或者干脆不提你——没有人会告诉你。我们用数据告诉你。
一切发布物遵循固定编辑标准;结论、观点和一切以「推荐」名义发布的内容由人写、人核对。每份报告开头都挂这样一张卡:
完整试点——40 条提示词 × 8 个助手——连同提示词日志和回答摘录正在发布。以下为试跑核心数字:
| AI 助手 | 提及率(前三) | 平均首发位次 | 参数准确度 | 典型行为 |
|---|---|---|---|---|
| 豆包 | 76% | 1.7 | 89% | 清单式回答,头部品牌共识强 |
| Kimi | 68% | 2.0 | 85% | 引用评测源较多,长尾覆盖好 |
| 元宝 | 61% | 2.3 | 81% | 偶有价格滞后 |
| 文心 | 55% | 2.6 | 83% | 倾向百科与权威源 |
| 淘宝问问 | 49% | 2.9 | 88% | 直接挂商品链接,生态内品牌优先 |
| ChatGPT | 42% | 3.4 | 71% | 中国市场品牌与在售型号最弱 |
试点试跑数字,用于展示报告形态。正式版表格附完整提示词日志、日期与模型版本。完整报告 →
我们把同样的购买意图分别问给中国模型(豆包、元宝、Kimi、文心、淘宝问问)和美国模型(ChatGPT、Claude、Gemini、Perplexity),每季度发布对比。只有同时在两个市场运营的团队才能做这件事——我们免费、双语、同步发布。
不能。报告由我们的诊断与托管服务、以及明确标注的 Newsletter 赞助支撑。榜单位置只由测试数据计算得出,谁也买不动。
中国组:豆包、腾讯元宝、Kimi、文心、淘宝问问。美国组:ChatGPT、Claude、Gemini、Perplexity。跨市场项目用同一组提示词问两边。
我们公开提示词、原始回答日志和计数规则。你可以不同意我们的结论——但你可以核查我们。联盟链接(如有)一律标注,且不进入打分。
可以——诊断是一次性交付;每季度我们还为研究路线图上的品类开放少量免费名额。看服务 →