做 GEO 之前得先知道盯哪几个引擎。 这篇用 3306 条真实回答,把六个国内 AI 引擎拆开看三件事:它给不给引用来源、一次给多少条、偏爱哪些站点。
数据来源:领航鲸探测库,统计区间 2026 年 7 月 30 日至 8 月 22 日,3306 条成功回答、28700 条引用记录。完整口径与全部表格见AI 引擎信源观测 2026-08 期,本文只讲怎么用这些数字做选择。
一、先分两类:能归因的,和不能归因的
不是每个引擎都告诉你它引了谁。 这一条比任何排名都重要——它直接决定你能不能验收效果。
| 引擎 | 成功回答 | 公开引用率 |
|---|---|---|
| 通义千问 | 881 | 99% |
| 文心一言 | 790 | 99% |
| 豆包 | 816 | 93% |
| DeepSeek(API) | 219 | 100% |
| DeepSeek(网页) | 170 | 99% |
| 腾讯元宝(API) | 135 | 100% |
| 腾讯元宝(网页) | 188 | 70% |
| Kimi(网页) | 94 | 72% |
好消息是:国内主流引擎基本都给来源。 这和一年前的普遍印象不同,也和「AI 是个黑盒、没法归因」的说法不符。
真正需要区别对待的是腾讯元宝网页版和 Kimi 网页版这一档——七成给、三成不给。对它们做归因,你能确认「提及率有没有变」,但确认不了「是哪篇稿子被引了」。把不公开引用的那部分标成「不可归因」,而不是按 0 分算,否则会系统性拉低总分,得出错误结论。
二、同一个引擎,换个入口结果就变
这是本期最值得单独说的一条。
看上面那张表里成对出现的两行:
| 引擎 | API 通道 | 网页通道 | 差距 |
|---|---|---|---|
| DeepSeek | 100% | 99% | 几乎没有 |
| 腾讯元宝 | 100% | 70% | 30 个百分点 |
同一个品牌、同一批问题、同一套抽取逻辑,只是问的入口不一样,腾讯元宝给不给来源的比例就差了三成。
对品牌方的含义是:你的「AI 可见度」不是一个数,而是一组数。 用户在手机 App 里问和通过接口问,看到的答案结构可能不同。监测只覆盖一条通道,就只知道那条通道的情况。
我们还有一条 Kimi 的 API 通道,同期 150 条回答里只有 3 条带引用。这个数字我们没有发布,因为还没核实调用时有没有请求联网检索——如果本来就没开检索,那 2% 描述的是我们的调用方式,不是 Kimi 的性质。拿没核实的数字去公开说一家具名公司,正是这个行业该少做的事。核实清楚之前,信源观测报告里也不会列它。
三、给引用的,一次给几条
公开率只回答「给不给」,不回答「给多少」。给得多意味着单条答案里有更多坑位。
| 引擎 | 带引用时平均引用数 |
|---|---|
| DeepSeek(API) | 19.3 |
| 腾讯元宝(网页) | 15.8 |
| DeepSeek(网页) | 12.6 |
| 豆包 | 10.2 |
| 文心一言 | 8.8 |
| 腾讯元宝(API) | 7.1 |
| 通义千问 | 4.9 |
| Kimi(网页) | 4.8 |
腾讯元宝网页版是个反直觉的例子:它公开率最低(70%),但它开口时给得最多(15.8 条)。 「公开率低」不等于「不检索」——它检索了,只是多数时候不告诉你。
反过来,通义千问公开率 99% 但平均只给 4.9 条。坑位少意味着竞争更激烈:同样是被引用一次,在通义里的稀缺度高于在 DeepSeek 里。
四、各家的口味几乎不重合
同一批问题下,六个引擎的头部信源几乎没有交集:
| 引擎 | 第一信源 | 第二信源 |
|---|---|---|
| 文心一言 | 百家号 baijiahao.baidu.com(930) | 搜狐 www.sohu.com(366) |
| 豆包 | 今日头条 m.toutiao.com(565) | 搜狐 m.sohu.com(380) |
| 通义千问 | 搜狐 www.sohu.com(258) | 新浪看点 k.sina.com.cn(250) |
| DeepSeek(网页) | 百度百科 baike.baidu.com(122) | 阿里云开发者社区 developer.aliyun.com(98) |
| Kimi(网页) | 博客园 www.cnblogs.com(22) | 搜狐 www.sohu.com(20) |
两条规律:
第一,各家先吃自己生态里的东西。 文心一言的第一信源是百家号,豆包是今日头条,都是自家平台。这不是巧合,是收录链路决定的——自家内容抓得最全、最快。
第二,搜狐是唯一在多个引擎里都排进前二的站点。 它不属于任何一家的生态,却被通义、豆包、Kimi 同时引用。这类跨引擎通吃的站点,同样的投入覆盖面差好几倍。
腾讯元宝网页版是个例外:它的头部信源里,前三名各只被引用过 1 次。它没有稳定偏爱的信源池,每次引的都不一样。 对这类引擎,与其押某个平台,不如把内容铺得更散。
五、海外引擎:我们还不能给你数字
本期数据里也有 ChatGPT、Gemini、Perplexity、Claude、Grok,但每个引擎的样本都不足 10 条,按口径不单列。
几条回答算出来的百分比是噪声,不是结论,印出来只会被当成结论。我们宁可空着这一栏。出海品牌的打法差异见出海品牌的 GEO,等样本攒够会在后续期次补上。
六、所以该盯哪几个
按品牌类型给一个起手顺序:
- 所有品牌都必须盯豆包、文心一言、通义千问。 三家样本量最大、公开率都在 93% 以上,归因链路完整,而且分别对应字节、百度、阿里三个内容生态;
- 内容偏技术、偏专业的,加 DeepSeek。 它引用密度最高(网页 12.6 条、API 19.3 条),坑位最多,而且偏爱百度百科与云厂商开发者社区这类结构化站点;
- 腾讯生态里有分发的,加腾讯元宝。 注意它网页版公开率只有 70%,验收口径要提前说清楚;
- Kimi 视品类而定。 样本较小,且它偏爱博客园这类技术社区,非技术品类的收益不明显。
一个反面提醒:别拿品牌词的数字汇报成果。 你问 AI「XX 怎么样」,它当然会说 XX——本期品牌词提及率 93%,头部词只有 17%。真正的战场在头部词、腰部词和长尾词那三层。
常见疑问
问:国内 AI 引擎到底给不给引用来源?
基本都给。本期实测通义千问 99%、文心一言 99%、豆包 93%、DeepSeek 网页版 99%。公开率明显偏低的是腾讯元宝网页版(70%)和 Kimi 网页版(72%),它们检索了,只是多数时候不显示来源。
问:为什么同一个引擎要分 API 和网页两条通道看?
因为它们是两条不同的检索通道,结果可以差很多。本期腾讯元宝 API 通道公开率 100%,网页通道只有 70%,差 30 个百分点。合并成一个数字会让百分比变成抽样比例的产物,既不描述 API 也不描述网页。
问:只盯一个引擎行不行?
不建议。各引擎的头部信源几乎不重合——文心一言最爱百家号、豆包最爱今日头条、DeepSeek 最爱百度百科与云厂商社区。只盯一个引擎,等于只优化了一条内容链路。
问:哪个引擎的坑位最多?
DeepSeek。它带引用时平均给 19.3 条(API)和 12.6 条(网页),远高于通义千问的 4.9 条。坑位多意味着更容易挤进去,但也意味着单次被引的权重更低。
问:ChatGPT、Gemini 这些为什么没有数据?
本期每个海外引擎的样本都不足 10 条,按口径不单列。几条回答算出的百分比是噪声,印出来会被当成结论。
问:这份对比多久更新一次?
跟着信源观测报告按期更新,口径固定,跨期数字可以直接比较。
---
想知道你的品牌在这六个引擎里分别排第几?免费探测一次,十分钟出报告。
延伸阅读:AI 引擎信源观测 2026-08 期、AI 引擎最爱引用哪些平台、GEO 效果怎么归因、AI 为什么推荐某些品牌。
参考资料:KDD 2024《GEO: Generative Engine Optimization》、Google《AI features and your website》。