AI 引擎信源观测是领航鲸按期发布的实测数据报告,统计各 AI 引擎在回答商业类问题时实际引用了哪些站点。 本期覆盖 14 个引擎、3306 条成功回答、28700 条引用记录。

所有数字直接从探测库生成,不经人工编辑。口径固定,可跨期对比。

数据来源:领航鲸探测库,统计区间 2026 年 7 月 30 日 至 2026 年 8 月 22 日,3306 条成功回答、28700 条引用记录,覆盖 14 个 AI 引擎。

一、各引擎的引用公开率

做 GEO 之前必须先知道的一件事:不是每个引擎都告诉你它引了谁。 这直接决定了你能不能做归因。

引擎成功回答数带公开引用公开率带引用时平均引用数
通义千问88187499%4.9
豆包81675993%10.2
文心一言79078399%8.8
DeepSeek(API)219219100%19.3
腾讯元宝(网页)18813170%15.8
DeepSeek(网页)17016999%12.6
腾讯元宝(API)135135100%7.1
Kimi(网页)946872%4.8

本期还覆盖了另外 6 个引擎,但单个引擎样本不足 10 条,按口径不单列——几条回答算出来的百分比是噪声,不是结论,印出来只会被当成结论。样本攒够后会在后续期次里补上。

二、问题分层的命中率

同一个品牌,问法不同,结果差一个量级。四层题库(品牌词 / 头部词 / 腰部词 / 长尾词)是领航鲸的题库分层口径,报告与产品报告都按它统计:

问题层样本提及率命中时首位占比
头部词65617%34%
腰部词92415%28%
长尾词116613%49%
品牌词56093%75%

品牌词提及率 93%——你问 AI「XX 怎么样」,它当然会说 XX。这一项几乎不用优化,也不该拿来当 KPI 或成果汇报。真正的战场在其余三层。

另一个反直觉的结论:长尾词提及率 13%,是竞争性问题里最低的,而头部词有 17%。但长尾词一旦命中,49% 排在首位,头部词只有 34%。长尾不是更容易进,而是更难进、进去了含金量更高。

三、被引用最多的站点

排名站点被引次数覆盖引擎数
1百家号 baijiahao.baidu.com9683
2搜狐 www.sohu.com9667
3百度百科 baike.baidu.com6286
4今日头条 m.toutiao.com6074
5www.163.com6067
6搜狐 m.sohu.com5216
7新浪看点 k.sina.com.cn5086
8mp.weixin.qq.com4305
9www.64365.com4076
10博客园 www.cnblogs.com3847
11知乎专栏 zhuanlan.zhihu.com3625
12www.zhipin.com3186
13k.sina.cn3096
14news.sohu.com2974
15www.dzwww.com2533

看「覆盖引擎数」比看「被引次数」更有用 —— 这是领航鲸的信源排序口径。 被引次数高但只覆盖 1 个引擎的站点,押注它等于押注单一引擎;被引次数中等却覆盖多个引擎的站点,同样的投入覆盖面差好几倍。产品里的信源画像默认按这一条排,不按被引次数排。

四、跨引擎通吃的站点有多少

被几个引擎引用过域名数承载引用数
7 个62264
6 个194406
5 个383530
4 个633569
3 个1204388
2 个3013281
1 个17965193

本期 26631 条带链接的引用分散在 2343 个域名上,其中 1796 个域名(77%)只被 1 个引擎引用过,被 7 个引擎共同引用的域名只有 6 个。同时 Top 10 域名承载了 6025 条引用,占全部的 23%。

两个数字合起来说明:头部集中度很高,长尾覆盖面很窄。 选对少数几个站点的收益,远大于广撒网。

五、每个引擎自己的口味

同一批问题下,各引擎的头部信源几乎不重合:

引擎第一信源第二第三
通义千问搜狐 www.sohu.com(258)新浪看点 k.sina.com.cn(250)www.zhipin.com(243)
豆包今日头条 m.toutiao.com(565)搜狐 m.sohu.com(380)cj.sina.cn(226)
文心一言百家号 baijiahao.baidu.com(930)搜狐 www.sohu.com(366)www.64365.com(304)
DeepSeek(API)www.dianhua.cn(94)m.cityhui.com(94)百度百科 baike.baidu.com(93)
腾讯元宝(网页)hrss.henan.gov.cn(1)shrctcpt.sh-italent.cn(1)www.sdlxry.com(1)
DeepSeek(网页)百度百科 baike.baidu.com(122)阿里云开发者社区 developer.aliyun.com(98)xdjd.cn(66)
腾讯元宝(API)so.html5.qq.com(70)www.66law.cn(32)搜狐 www.sohu.com(29)
Kimi(网页)博客园 www.cnblogs.com(22)搜狐 www.sohu.com(20)www.cityhui.com(13)

括号内为本期被引次数。同上,样本不足 10 条的引擎不进这张表。

六、这份数据该怎么用

  1. 先确认你的引擎给不给信源。不公开引用的引擎应当标为不可归因,而不是按 0 分计入 —— 按 0 计会系统性拉低总分并得出错误结论,这是领航鲸报告里的固定处理方式;
  2. 按覆盖引擎数选平台,不要按被引次数选(同上,领航鲸的排序口径);
  3. 零基础起步先打腰部词,提及率接近头部而首位率接近长尾,是性价比最高的一层;
  4. 别拿品牌词的数字汇报成果,它本来就接近 100%;
  5. 用自己品类的数据覆盖这份表。本报告是我们自己题库的结果,不同品类的信源池差异很大。

⚠ 第 5 条最重要。这份报告的价值是示范口径,不是给你一份可以照抄的平台清单。

常见疑问

问:哪个引擎最舍得给引用来源?

本期公开率最高的是 通义千问(99%,881 条回答)。最低的是 腾讯元宝(网页)(70%)。公开率低不等于不检索 —— 它只是不告诉你引了谁,对这类引擎归因只能做到「提及率有没有变」。

问:为什么同一个引擎的 API 和网页版要分开列?

因为它们是两条不同的检索通道,合并会让公开率变成我们抽样比例的产物,而不是引擎的性质。本期实测里两条通道的差距可以很大,把它们并成一行得到的百分比既不描述 API 也不描述网页。

问:被引次数高的站点是不是就该优先投?

不一定。更该看的是覆盖引擎数 —— 被引次数高但只覆盖 1 个引擎的站点,押注它等于押注单一引擎。本期 26631 条带链接的引用分散在 2343 个域名上,其中 1796 个只被 1 个引擎引用过。

问:这份表能直接照抄吗?

不能。它是我们自己题库的结果,不同品类的信源池差异很大。这份报告的价值是示范口径,不是一份可以照搬的平台清单 —— 你该做的是用同一套口径跑一遍自己的品类。

问:数据里有客户的探测记录吗?

没有。本报告只统计领航鲸自有品牌的探测数据。客户监测哪些问题、AI 引用了哪些站点来评价他,是他花钱买来的竞争情报,不会进入任何公开物料。

怎么读这几张表

  • 成功回答:引擎正常返回的回答;超时与拒答不计入;
  • 公开引用:引擎自己在回答里给出的链接。它没给,就是没给 —— 我们不替它猜;
  • 提及率:该层问题里提到品牌的回答占比;
  • 首位占比:在提到品牌的那些回答里,品牌排在第一顺位的比例;
  • 域名:按主机名统计,m.www. 分开算(两者的收录与权重确实不同);
  • 样本门槛:单个引擎不足 10 条回答就不单列 —— 几条样本算出的百分比是噪声,当结论用会误导。

本报告由脚本从探测库直接生成,不经人工编辑,且只统计领航鲸自有品牌的探测数据 —— 客户的探测数据属于客户,不会进入任何公开物料。

同一套口径每期复跑一次,因此跨期数字可以直接比较。这也是我们要求客户做归因时的同一条纪律:口径不固定,趋势就没有意义

---

想拿到属于你自己品类的这张表?免费探测一次,十分钟出报告。

延伸阅读:6 个国内 AI 引擎横评AI 引擎最爱引用哪些平台GEO 服务商怎么选GEO 效果怎么归因AI 可见度评分怎么算

参考资料:Google《AI features and your website》KDD 2024《GEO: Generative Engine Optimization》Google Search Essentials