做 GEO 之前得先知道盯哪几个引擎。 这篇用 3306 条真实回答,把六个国内 AI 引擎拆开看三件事:它给不给引用来源、一次给多少条、偏爱哪些站点。

数据来源:领航鲸探测库,统计区间 2026 年 7 月 30 日至 8 月 22 日,3306 条成功回答、28700 条引用记录。完整口径与全部表格见AI 引擎信源观测 2026-08 期,本文只讲怎么用这些数字做选择。

一、先分两类:能归因的,和不能归因的

不是每个引擎都告诉你它引了谁。 这一条比任何排名都重要——它直接决定你能不能验收效果。

引擎成功回答公开引用率
通义千问88199%
文心一言79099%
豆包81693%
DeepSeek(API)219100%
DeepSeek(网页)17099%
腾讯元宝(API)135100%
腾讯元宝(网页)18870%
Kimi(网页)9472%

好消息是:国内主流引擎基本都给来源。 这和一年前的普遍印象不同,也和「AI 是个黑盒、没法归因」的说法不符。

真正需要区别对待的是腾讯元宝网页版和 Kimi 网页版这一档——七成给、三成不给。对它们做归因,你能确认「提及率有没有变」,但确认不了「是哪篇稿子被引了」。把不公开引用的那部分标成「不可归因」,而不是按 0 分算,否则会系统性拉低总分,得出错误结论。

二、同一个引擎,换个入口结果就变

这是本期最值得单独说的一条。

看上面那张表里成对出现的两行:

引擎API 通道网页通道差距
DeepSeek100%99%几乎没有
腾讯元宝100%70%30 个百分点

同一个品牌、同一批问题、同一套抽取逻辑,只是问的入口不一样,腾讯元宝给不给来源的比例就差了三成。

对品牌方的含义是:你的「AI 可见度」不是一个数,而是一组数。 用户在手机 App 里问和通过接口问,看到的答案结构可能不同。监测只覆盖一条通道,就只知道那条通道的情况。

我们还有一条 Kimi 的 API 通道,同期 150 条回答里只有 3 条带引用。这个数字我们没有发布,因为还没核实调用时有没有请求联网检索——如果本来就没开检索,那 2% 描述的是我们的调用方式,不是 Kimi 的性质。拿没核实的数字去公开说一家具名公司,正是这个行业该少做的事。核实清楚之前,信源观测报告里也不会列它。

三、给引用的,一次给几条

公开率只回答「给不给」,不回答「给多少」。给得多意味着单条答案里有更多坑位。

引擎带引用时平均引用数
DeepSeek(API)19.3
腾讯元宝(网页)15.8
DeepSeek(网页)12.6
豆包10.2
文心一言8.8
腾讯元宝(API)7.1
通义千问4.9
Kimi(网页)4.8

腾讯元宝网页版是个反直觉的例子:它公开率最低(70%),但它开口时给得最多(15.8 条)。 「公开率低」不等于「不检索」——它检索了,只是多数时候不告诉你。

反过来,通义千问公开率 99% 但平均只给 4.9 条。坑位少意味着竞争更激烈:同样是被引用一次,在通义里的稀缺度高于在 DeepSeek 里。

四、各家的口味几乎不重合

同一批问题下,六个引擎的头部信源几乎没有交集:

引擎第一信源第二信源
文心一言百家号 baijiahao.baidu.com(930)搜狐 www.sohu.com(366)
豆包今日头条 m.toutiao.com(565)搜狐 m.sohu.com(380)
通义千问搜狐 www.sohu.com(258)新浪看点 k.sina.com.cn(250)
DeepSeek(网页)百度百科 baike.baidu.com(122)阿里云开发者社区 developer.aliyun.com(98)
Kimi(网页)博客园 www.cnblogs.com(22)搜狐 www.sohu.com(20)

两条规律:

第一,各家先吃自己生态里的东西。 文心一言的第一信源是百家号,豆包是今日头条,都是自家平台。这不是巧合,是收录链路决定的——自家内容抓得最全、最快。

第二,搜狐是唯一在多个引擎里都排进前二的站点。 它不属于任何一家的生态,却被通义、豆包、Kimi 同时引用。这类跨引擎通吃的站点,同样的投入覆盖面差好几倍。

腾讯元宝网页版是个例外:它的头部信源里,前三名各只被引用过 1 次。它没有稳定偏爱的信源池,每次引的都不一样。 对这类引擎,与其押某个平台,不如把内容铺得更散。

五、海外引擎:我们还不能给你数字

本期数据里也有 ChatGPT、Gemini、Perplexity、Claude、Grok,但每个引擎的样本都不足 10 条,按口径不单列。

几条回答算出来的百分比是噪声,不是结论,印出来只会被当成结论。我们宁可空着这一栏。出海品牌的打法差异见出海品牌的 GEO,等样本攒够会在后续期次补上。

六、所以该盯哪几个

按品牌类型给一个起手顺序:

  1. 所有品牌都必须盯豆包、文心一言、通义千问。 三家样本量最大、公开率都在 93% 以上,归因链路完整,而且分别对应字节、百度、阿里三个内容生态;
  2. 内容偏技术、偏专业的,加 DeepSeek。 它引用密度最高(网页 12.6 条、API 19.3 条),坑位最多,而且偏爱百度百科与云厂商开发者社区这类结构化站点;
  3. 腾讯生态里有分发的,加腾讯元宝。 注意它网页版公开率只有 70%,验收口径要提前说清楚;
  4. Kimi 视品类而定。 样本较小,且它偏爱博客园这类技术社区,非技术品类的收益不明显。

一个反面提醒:别拿品牌词的数字汇报成果。 你问 AI「XX 怎么样」,它当然会说 XX——本期品牌词提及率 93%,头部词只有 17%。真正的战场在头部词、腰部词和长尾词那三层。

常见疑问

问:国内 AI 引擎到底给不给引用来源?

基本都给。本期实测通义千问 99%、文心一言 99%、豆包 93%、DeepSeek 网页版 99%。公开率明显偏低的是腾讯元宝网页版(70%)和 Kimi 网页版(72%),它们检索了,只是多数时候不显示来源。

问:为什么同一个引擎要分 API 和网页两条通道看?

因为它们是两条不同的检索通道,结果可以差很多。本期腾讯元宝 API 通道公开率 100%,网页通道只有 70%,差 30 个百分点。合并成一个数字会让百分比变成抽样比例的产物,既不描述 API 也不描述网页。

问:只盯一个引擎行不行?

不建议。各引擎的头部信源几乎不重合——文心一言最爱百家号、豆包最爱今日头条、DeepSeek 最爱百度百科与云厂商社区。只盯一个引擎,等于只优化了一条内容链路。

问:哪个引擎的坑位最多?

DeepSeek。它带引用时平均给 19.3 条(API)和 12.6 条(网页),远高于通义千问的 4.9 条。坑位多意味着更容易挤进去,但也意味着单次被引的权重更低。

问:ChatGPT、Gemini 这些为什么没有数据?

本期每个海外引擎的样本都不足 10 条,按口径不单列。几条回答算出的百分比是噪声,印出来会被当成结论。

问:这份对比多久更新一次?

跟着信源观测报告按期更新,口径固定,跨期数字可以直接比较。

---

想知道你的品牌在这六个引擎里分别排第几?免费探测一次,十分钟出报告。

延伸阅读:AI 引擎信源观测 2026-08 期AI 引擎最爱引用哪些平台GEO 效果怎么归因AI 为什么推荐某些品牌

参考资料:KDD 2024《GEO: Generative Engine Optimization》Google《AI features and your website》