900万条AI回答的实测结论:决定AI引用的是信息深度,不是口碑也不是列表体

过去两年,GEO 行业里流传着几条听起来无懈可击的常识:把品牌口碑做好,AI 就会更愿意引用你;把内容排成清单体,AI 就会优先抓取;把自己的产品页写透,商业意图的提问自然落到你头上。Neil Patel 团队在 brightonSEO 2026 上公布的一项研究,用 900 万条 AI 回答、覆盖 9 个平台和 400 多个企业品牌的数据,把这三条逐一打穿了。整份研究里最扎眼的一句结论是:AI 挑选信源的方式,跟营销人过去十年的直觉基本是反的。
口碑越好,被引用越少
第一条被推翻的是「口碑换引用」。研究团队在 ChatGPT、Google AI Mode、Gemini、Copilot 和 Grok 五个平台上做了交叉比对,发现品牌情绪与引用频次的相关性是负的,或者至少是平的——评论更好、口碑更干净的品牌,并没有因此获得更多引用;反而是一些争议缠身、被反复讨论的品牌,出现在答案里的概率更高。团队给出的机制解释很朴素:这些模型检索的依据是「品牌被讨论的频次与深度」,不是「人们喜不喜欢这个品牌」。争议带来的讨论量,是安静的好品牌永远追不上的。所以在线声誉管理(ORM)该做还得做,它影响转化和信任,只是别再把引用数量记在它的账上。
64% 的引用来自普通网页
第二条被推翻的是「列表体通行证」。行业里流行把内容改写成 listicle、how-to 或对比榜单,理由是「这样 AI 才好摘」。数据说不是:64% 的 AI 引用来自普通网页,而不是这些专门为被引用而生的格式。原因也简单——模型要的是「哪一段最能回答这个提问」,跟格式无关。一个写得够透的品类页或深度指南,覆盖的问题面往往比一份凑数清单更宽,被抽中的机会自然更多。把 GEO 当成排版练习,是这一轮里最普遍的误判。
商业意图提问里,自有页面只占 3%
第三条最反直觉:你以为自己的产品页和定价页会在商业意图提问里说话,实际上它们几乎没有发言权。在带商业意图的 prompt 上,82% 的引用指向第三方来源,品牌自有页面只占 3%——而在导航类和信息类提问里,自有页面还能占到 13%。翻译一下:用户正要掏钱的那一刻,这些模型默认「除了卖家本人,谁说的都更可信」。你自己的定价页,是它们最后才会去看的地方。这条直接改写了数字公关的预算分配:与其把资源全砸在漏斗顶端的品牌曝光,不如瞄准定价对比、品类测评、best-for 这类离成交最近的第三方内容位。
波动是品牌自己的问题
研究中还有一个常被忽略的细节:可见度波动主要是品牌自己的问题,不是模型不稳定。按平台算,波动区间是 0.08 到 0.32;按品牌算,波动区间是 0.04 到 1.0——品牌级波动比平台级大了一个量级。而一个在某个平台上赢的品牌,通常在其它平台上也在赢。换句话说,某个季度 AI 可见度掉了,先别归因于「模型又更新了」,更可能是自己的内容权威度和讨论深度在这段时间里松了。
被引用一次,杠杆是 5 倍
那什么才是真正有效的杠杆?研究里最强的一个信号是自有内容被引用:当 AI 答案直接链接到你的域名时,整体可见度的提升幅度约为 5 倍,是整份数据里单项最强的效应;而且自有内容的引用持续性,是第三方引用的 3 到 9 倍。这构成了一个有点矛盾的结论:第三方来源垄断了商业意图提问,但一旦抢到自有页面的引用位,回报也最大。至于该往哪个第三方渠道使劲,研究给了一个和主流叙事不一致的排序:YouTube 带来 2.8 倍的可见度提升,排在 LinkedIn(2.7 倍)、Reddit(2.4 倍)、G2(1.9 倍)和 Gartner(1.6 倍)之前。Reddit 在 SEO 圈被当成「AI 可见度的唯一答案」,数据上它连第一名都不是——大多数品牌还把 YouTube 当作品牌内容频道,而不是引用来源。
另一份基准:E-E-A-T 只拿到 2 分
如果说上面这份研究回答的是「什么没用」,另一份同期公开的基准数据回答的是「大家差在哪」。GEO 分析平台 GEO-Score 在 10 月 3 日更新的全站基准里,把站点拆成七个因子打分:引用密度 61/100 是全场最强项,内容结构 57.8、全面性 54.3 也还过得去;但新鲜度只有 30.8,AI 优化相关的工程化处理 29,可读性 11.9,而 E-E-A-T 质量只有 2/100——几乎所有站点在这一项上都接近零分。这个分布的意义在于:弱项之所以弱,是因为没人做,而不是因为做不了。在竞品集体缺位的地方补课,边际收益最高。
需求端的时钟走得更快
需求端的时钟走得更快。Adobe 面向企业的品牌可见度数据显示,系统性地执行 GEO 策略的品牌,六个月内引用权威度平均提升 30%;2026 年的市场调研则指出 70% 的 B2B 买家已经把 AI 搜索当成筛选供应商的首选工具;八个词以上的长提问同比涨了 700%,AI 引荐流量里 ChatGPT 占 77.97%、Perplexity 占 15.10%、Gemini 占 6.40%。用户提问的形态在变长、变具体,靠短关键词覆盖的老办法在两端都在贬值。
今天就能动手的四件事
如果要把上面的结论压成几条能今天就动手的事:第一,重做一遍内容审计,把每个核心页面的「可抽取事实密度」标出来——具体数字、日期、机构名、口径,缺哪样补哪样;第二,把第三方提及当成 KPI,锁定 YouTube、LinkedIn 和行业评测位,而不是只盯自家官网的改版;第三,商业意图词上别指望自有页面,主动去做定价对比和品类测评的第三方内容;第四,把 E-E-A-T 从零分拉起来,作者资质、机构主体、信息来源这几件事,成本低但全场没人做。
想找国内可用的 AI 搜索入口,可以看我们对 秘塔AI搜索 的收录页;行业层面持续跟踪模型与产品动向,推荐 机器之心 这类垂媒。
模型在变、平台在变,但「谁的内容更有信息密度、谁被讨论得更多」这条底层逻辑已经连续两年被数据反复验证。GEO 不是玄学,它只是把过去那些靠位置优势蒙混过关的页面,重新筛了一遍。
(文 / AI30媒体部 | 2026年10月4日)



