生成式引擎优化(GEO)· 行业实测
国产 AI 引擎 GEO 实测研究 2026
用真实浏览器对豆包、DeepSeek、腾讯元宝、通义千问、文心一言、Kimi 六家国产 AI 引擎逐题提问,量化谁的回答会引用外部内容、引用谁的——回答 GEO 最核心的问题:内容铺在哪里,才会被 AI 看见。
核心结论
从 72 次单次实测回答与 97 次多次采样中提炼的五条最重要发现。
引用能力严重分化
文心一言每题必引(12/12),元宝、千问各 10/12,豆包、DeepSeek 各 9/12,而 Kimi 仅 3/12——9 题纯模型作答,外链内容很难影响它的回答,GEO 投入优先级应排最后。
自家生态就是信源护城河
豆包 9/12 题引用抖音视频、7/12 题引用今日头条;元宝 48 次引用微信公众号、约占其全部引用的 1/3;文心高频引用百度系(爱企查、百科、百家号)。没有对应生态内容的品牌几乎无法获得曝光。
DeepSeek 被单次测试低估
开启「智能搜索」后,DeepSeek 在 32 次多次采样中全部联网引用(100%),单次 9/12 只是部分题未触发联网。DeepSeek 应列入第一梯队高引用引擎。
知乎不是主要被引来源
实测中知乎几乎只在文心的引用里零星出现。真正被高频引用的是:CSDN、博客园、搜狐、网易、今日头条、微信公众号。GEO 铺内容的渠道优先级应按实测调整。
品牌自建内容能被直接引用
晓多官方博客同时进入豆包、元宝、DeepSeek 的引用;抖音电商学习中心被豆包/DeepSeek/元宝反复引用;飞书云文档被 DeepSeek 和千问引用。「自建结构化问答库会被引用」的推断被证实。
数据图表
所有图表均附文字总结与数据表,原始明细见文末「12 题明细」。
图 1 · 六引擎单次实测引用率
文字总结:单次实测(每引擎 12 题,n=1)中,文心一言 12/12 全部带引用居首;腾讯元宝与千问各 10/12;豆包与 DeepSeek 各 9/12;Kimi 仅 3/12,明显垫底——其回答大部分由模型参数直接生成。
查看数据表
| 引擎 | 完成题数 | 有引用题数 | 引用率 | 引用特征 |
|---|---|---|---|---|
| 文心一言(文心5.1+深度思考) | 12/12 | 12/12 | 100% | 每题引 21-33 篇共 321 条,但长尾小自媒体极多、噪音大 |
| 腾讯元宝(默认模型) | 12/12 | 10/12 | 83% | 公众号一家独大:48 条,约占全部引用 1/3 |
| 千问(Qwen3.7) | 12/12 | 10/12 | 83% | 引用面最广:新闻媒体 + 百度系 + 机构官网 + 长尾黄页 |
| 豆包 | 12/12 | 9/12 | 75% | 抖音视频 9 题、今日头条 7 题,字节系霸榜 |
| DeepSeek(开智能搜索) | 12/12 | 9/12 | 75% | 新闻媒体 + 投诉/政务 + 品牌官网,信源最「杂而正」 |
| Kimi | 12/12 | 3/12 | 25% | 9 题纯模型作答不联网;有引用也是 CSDN/搜狐等内容农场 |
图 2 · 多次采样引用率(97 次,样本不完整)
文字总结:原计划每题 5 次 × 5 引擎,执行中 DeepSeek 触发平台风控而停止,落盘 97 条有效采样。DeepSeek 32/32 全部引用(100%)——单次测试严重低估了它;元宝 48/54(89%),公众号主导地位在 54 次采样下成立(43/54 次采样含 mp.weixin.qq.com);豆包仅完成 Q1-Q3 共 11 次,5/11(45%),仅供参考。
查看数据表
| 引擎 | 有效采样 | 引用率 | 覆盖题目 |
|---|---|---|---|
| DeepSeek | 32 次 | 100%(32/32) | 7 题(Q1-Q6 各 5 次,Q7 2 次) |
| 腾讯元宝 | 54 次 | 89%(48/54) | 11 题(每题 4-5 次) |
| 豆包 | 11 次 | 45%(5/11) | 仅 Q1-Q3,样本不全,仅供参考 |
图 3 · 12 题 × 6 引擎引用热力图
文字总结:Q5(训练营真假)、Q7(小鹅通平替)两题六家全部引用,Q4(批量做带货短视频)5/6(仅 Kimi 未联网),是最「可被引用」的题型;Q11/Q12(B 端私域运营)只有元宝 Q11 和文心、千问有引用,豆包/DeepSeek/Kimi 全部纯模型作答——做这两题的内容应优先发公众号和百家号。Kimi 整行仅 3 格有引用。
查看数据表(✓=有引用,✗=无引用)
| 题目 | 文心 | 元宝 | 千问 | 豆包 | DeepSeek | Kimi |
|---|
图 4 · 各引擎 Top 引用域名 / 信源
文字总结:
查看数据表(当前所选引擎)
| 信源 | 次数 | 统计口径 |
|---|
图 5 · 六引擎 MAU 量级对比
文字总结:以 QuestMobile 2025-12 口径为主:豆包 2.26 亿稳居第一(DAU 也最高,5410 万);DeepSeek 1.35 亿居第二;千问官方称 2026-01 破亿(官方口径,不可直接横比);Kimi 约 900 万且在萎缩;文小言 App 端仅约 530 万(但「文心助手」含百度 App 入口口径称 2 亿)。腾讯元宝无精确公开数字,定性为「行业第三、增长最快(年复合增长率 27.8%)」,故未在图中给出柱值。
查看数据表
| 引擎 | MAU 量级 | 口径说明 |
|---|---|---|
| 豆包(字节) | 2.26 亿 | QuestMobile 2025-12;DAU 5410 万(2025-10)亦为最高 |
| DeepSeek | 1.35 亿 | QuestMobile 2025-12;从 2025-02 峰值 1.94 亿回落 |
| 千问(阿里) | 约 1 亿 | 官方称 2026-01 破亿(官方口径);阿里 C 端另有夸克 DAU 3370 万 |
| 腾讯元宝 | 行业第三(定性) | 无精确公开数;增长最快,年复合增长率 27.8% |
| Kimi(月之暗面) | 约 900 万且萎缩 | 官方转向 Agent 商业化,不追用户数 |
| 文心一言/文小言(百度) | App 端约 530 万 | App 端弱势;「文心助手」含百度 App 入口口径称 2 亿 |
引擎信源偏好对照表
信源偏好是 GEO 的核心打法差异:同一个品牌,在不同引擎上要铺完全不同的渠道。综合引擎格局研究(新榜智汇 2025-12、鲸牙启量 2026-02~07 样本)与本次实测修正。
| 引擎 | 核心信源 | GEO 实质动作 |
|---|---|---|
| 豆包 | 字节系:今日头条、抖音、西瓜视频(TOP5 信源中 3 个字节系),2025 下半年起抖音短视频权重上升 | 头条号 + 抖音号内容矩阵、抖音百科/百度百科普词条 |
| 腾讯元宝 | 微信公众号(约占信源 10%,单一渠道占比最高)、视频号、搜一搜 | 公众号 + 视频号矩阵;没有公众号内容的品牌几乎无法获得曝光 |
| 文心一言 | 百家号、百度百科、百度知道,与百度搜索收录深度绑定 | SEO 与 GEO 高度协同:百度收录权重高的站基本同步被引用,是「最稳定」的平台 |
| DeepSeek | 无自有生态,靠开放网页抓取:搜狐、网易、百度百科、行业媒体、白皮书、公共机构 | 多平台铺同口径内容(门户 + 百科 + 行业媒体),提高被抓取概率 |
| Kimi | 外采为主,偏微信公众平台、搜狐;企业官网/品牌页权重高(引用覆盖率 67.6%,六家最高之一) | 官网事实页 + 媒体报道 + 目录收录一致性 |
| 千问 | 权威媒体集中(媒体发布类信源显著偏高)、知识文档;夸克偏官方与学术源 | 权威媒体铺稿 + 官方文档/白皮书 |
12 题明细
每题独立新对话、逐字提问不改写。下表给出六家答案的一句话结论与是否有引用(✓ 有引用 / ✗ 纯模型作答)。题目来自广告电商与教育两个方向的真实用户提问。
Q1晓多跟乐言比店小蜜哪个好用5/6 有引用
Q2千川计划跑不动应该加价还是暂停计划4/6 有引用
Q3全域推广一直消耗不出单怎么办5/6 有引用
Q4怎么用 DeepSeek 和剪映批量做带货短视频5/6 有引用
Q5短视频带货训练营是真的吗6/6 有引用
Q6抖音小店无货源是割韭菜吗5/6 有引用
Q7小鹅通太贵了有什么平替6/6 有引用
Q8老师批改作文用什么 AI 工具好用5/6 有引用
Q9用 DeepSeek 豆包辅导孩子作业靠谱吗,会不会让孩子变懒4/6 有引用
Q10普通人需要花钱学 DeepSeek 吗4/6 有引用
Q11地推加来的家长微信怎么转化不被拉黑3/6 有引用
Q12开学季体验课来了很多人但转化率低怎么办2/6 有引用
方法论与局限
阅读本报告结论前,请先了解以下口径与边界——所有引用行为结论应视为方向性而非统计结论。
方法
- 单次实测:2026-08-05,通过 WebBridge 控制真实浏览器逐题提问,每题独立新对话、逐字提问不改写;六引擎各 12 题全部完成。千问匿名额度只够 4-5 个对话,Q5-Q12 为登录后补测。
- 多次采样:原计划每题 5 次 × 5 引擎做引用率统计,执行中 DeepSeek 触发平台风控而整体停止,停止前落盘 97 条有效采样(元宝 54、DeepSeek 32、豆包 11)。
- 引用提取:豆包/千问/文心的引用不在页面渲染为链接,分别从对话数据、接口数据与来源站名标注中提取;元宝/DeepSeek/Kimi 从引用卡片/角标的 href 域名提取。
局限
- n=1 口径:单次测试为单账号单次采样,AI 回答有随机性;多次采样仅覆盖元宝/DeepSeek/豆包三家且不完整,千问、文心的多次采样未做(文心单次 12/12 全引用,预计差异不大)。
- DeepSeek 风控事件:约 30 次连续提问后被平台判定违规——高频自动化提问会触发风控。后续做长期品牌可见度监测必须控制频率(分钟级间隔 + 每日上限),或用 GEOBase、新榜智汇等现成工具代替自建抓取。
- 文心引用为站名而非 URL:页面不渲染链接,精确域名需逐条点开,工作量大暂未做;其域名统计按站名归并,口径与其他五家略有差异。
- 知乎结论的修正:此前基于搜索语料推断「知乎是被引用最多的 UGC 形态」被实测推翻——知乎几乎只在文心引用中零星出现;豆包/DeepSeek/元宝/Kimi 引用里基本看不到知乎。真正高频被引的是 CSDN、博客园、搜狐、网易、今日头条、公众号。
- MAU 口径不可横比:以 QuestMobile 2025-12 为主口径;千问「破亿」、文心「2 亿」为官方口径,已单独标注。
- 商业化背景:截至 2026 年初,六家均无官方 AI 回答广告产品,市面所有「被 AI 推荐」服务都是有机 GEO 操作;DeepSeek 官方已明确表示在对低质 AIGC 铺稿内容识别降权——铺低质软文的路在收窄,真实数据型内容才是长期资产。