四十条购买意图提示词——预算、轴体、使用场景、人群——问了八个 AI 助手。本试点用于验证流水线;下列表格来自试跑数字并已标注,正式版将附完整提示词日志发布。
| AI 助手 | 提及率(前三) | 平均首发位次 | 参数准确度 | 典型行为 |
|---|---|---|---|---|
| 豆包 | 76% | 1.7 | 89% | 清单式回答,头部品牌共识强 |
| Kimi | 68% | 2.0 | 85% | 引用评测源较多,长尾覆盖好 |
| 元宝 | 61% | 2.3 | 81% | 偶有价格滞后 |
| 文心 | 55% | 2.6 | 83% | 倾向百科与权威源 |
| 淘宝问问 | 49% | 2.9 | 88% | 直接挂商品链接,生态内品牌优先 |
| ChatGPT | 42% | 3.4 | 71% | 中国市场品牌与在售型号最弱 |
「参数准确度」= 所述事实与测试时商家现行官方数据一致的比例。逐条日志随正式版发布。
同样 20 条核心提示词同时问了美国组(ChatGPT、Claude、Gemini、Perplexity)。初步规律:两个世界的「安全默认牌」重合率不到一半——而且中国组会推荐美国组从不提及的国内渠道生态。
四个中国助手第一推荐完全一致的提示词占 31%。2–3 个品牌的共识簇占 58%。
中美两组品牌名重合度:38%。对跨境买家这意味着:两边 AI 各推荐各的,你自己做功课的空间正在变小。
本试点由生产流水线产出;正式发布将补齐完整提示词日志、逐条回答摘录与模型版本串。下一个测试的品类由订阅者投票决定——把你的品类投上去,被选中后你的市场会先被测。