AI 是怎么挑答案的(What is GEO)
⏱ 阅读 15 分钟 | 🛠 动手 15 分钟 | 📍 对应关卡:Level 3
🎯 读完你能:说清楚 ChatGPT、Google AI 概览这些 AI 从哪里找信息、靠什么决定推荐谁,并完成一次 15 分钟的快速自测。
一句话讲清楚#
AI 回答问题,像一个帮你查资料的学霸同学:先上网搜一搜,挑几篇网页读一读,总结成一段话,最后标上"我参考了这几篇"。
GEO(Generative Engine Optimization,生成式引擎优化)就是:让这个学霸查资料时找得到你、读得懂你、愿意在答案里提到你。
为什么重要#
- 用户越来越多直接问 AI:"What's the best app to practice English speaking?"
- AI 通常只列出 3–5 个名字。不在名单里,用户就不知道你存在。
- Google 的 AI 概览(AI Overviews,搜索结果最上面那段 AI 总结)出现在 20% 以上的搜索里。出现时,没被引用的网站点击率下降约 60%,被引用的品牌点击反而更多。来源:Search Engine Land、Omnibound
- 好消息:AI 不只看大公司。Reddit 上一条真诚的讨论、一个写得清楚的对比页,都可能被引用。小产品有机会。
原理 1:学霸的两种"知识"#
AI 回答问题时,用的是两种知识。
| 脑子里记得的 | 现查的 | |
|---|---|---|
| 英文 | 训练数据(Training data) | 实时搜索(Retrieval / Grounding,接地:回答前先上网查证) |
| 怎么来的 | 模型训练时读过的海量网页 | 回答时临时去网上搜 |
| 有没有截止时间 | 有(训练数据截止日期,knowledge cutoff) | 没有,今天的网页也能查到 |
| 新产品能不能进去 | 很难,要等下一代模型,还要被提到得足够多 | 能。网页能被搜到、能被读懂就有机会 |
| 你能控制多少 | 很少 | 比较多 |
结论:新产品的主战场是"现查"。 你今天上线的产品,AI 脑子里一定没有。但只要它现查时能搜到你,下个月就可能出现在答案里。
原理 2:AI 查资料的 4 个步骤#
- 拆问题
- 用户问:"What's the best app to practice English speaking?"
- AI 会把它拆成好几个搜索词同时去查。Google 把这叫"查询扇出"(query fan-out)。
- 比如拆成:"best English speaking practice app 2026"、"AI speaking partner app reddit"、"app to practice English conversation free"。
- 搜索
- 用自己的搜索索引,或合作搜索引擎(Bing、Google)的数据,找到一批网页。
- 读网页
- 挑出前面的几篇快速读。
- 读不到的直接跳过:被 robots.txt 挡住的、要登录才能看的、内容全靠 JavaScript 加载的。
- 很多 AI 爬虫只读网页的原始 HTML,不执行 JavaScript。来源:Vercel
- 总结 + 标来源
- 把几篇网页里反复出现、说得清楚的信息写进答案,后面附上链接。
💡 关键在第 4 步。你自己的网站说你好,只是一个声音。Reddit、YouTube、评测文章里都有人提到你,AI 才会觉得"很多人都这么说",才敢写进答案。
原理 3:AI 从哪里获取信息#
| 信息来源 | 例子 | AI 为什么爱看 | 你能做什么 |
|---|---|---|---|
| 你的网站 | 首页、About 页、对比页、FAQ | 官方信息,最准确 | 写清楚你是谁、给谁用(见下一章) |
| r/languagelearning 里的"求推荐"帖 | 真人真实经验,AI 引用极多 | 真诚参与讨论,合规地提产品 | |
| YouTube | 测评视频、教程 | 有研究称在部分场景引用已超过 Reddit | 自己做演示视频;请中小博主试用 |
| 评测 / 榜单文章 | "10 Best English Speaking Apps in 2026" | AI 常常直接参考榜单 | 联系作者,提供免费试用 |
| 目录网站 | AlternativeTo、Product Hunt、G2、itch.io、Class Central | 分类清楚,信息结构化 | 花一个下午提交 |
| 维基百科 / 知识库 | Wikipedia、Wikidata | 权威 | 小产品一般上不了,别硬写(会被删) |
关于 Reddit:不同研究数字不同。有研究称 Perplexity 的引用约 46.7%、Google AI 概览的引用约 21% 来自 Reddit;也有研究称 YouTube 在部分场景已经超过 Reddit。来源:Red Engage、Adweek
这就是为什么本书把 Reddit、SEO、GEO 放在一起讲:你在 Reddit 上的真诚回答,同时也是 AI 的参考资料。
原理 4:主要 AI 产品和它们的爬虫#
先认识两个词:
- 爬虫(crawler,也叫 bot,机器人):自动来你网站读网页的程序。每家 AI 公司都有自己的爬虫,各有名字。
- robots.txt(爬虫规则文件):放在网站根目录的一个文本文件,告诉各家爬虫"哪里能进、哪里不能进"。在浏览器打开
yourdomain.com/robots.txt就能看到。
截至 2026 年 9 月,各家官方公布的情况如下:
| AI 产品 | 它靠什么找网页 | robots.txt 里的名字 | 作用 |
|---|---|---|---|
| ChatGPT 搜索 | 自己的索引 + Bing 的数据 | OAI-SearchBot |
决定你能不能出现在 ChatGPT 搜索结果里。必须放行 |
| ChatGPT(训练) | — | GPTBot |
收集训练数据。和 OAI-SearchBot 分开设置 |
| ChatGPT(用户让它打开网页) | 实时访问 | ChatGPT-User |
用户在对话里让 ChatGPT 看某个网页时来访。OpenAI 说这类用户发起的访问 robots.txt 可能不适用 |
| Google AI 概览 / AI 模式(AI Mode) | Google 搜索索引 | Googlebot |
页面被 Google 收录、允许显示摘要,就有资格被引用 |
| Gemini App | Google 抓取的内容 | Google-Extended |
不是单独的爬虫,是一个"控制开关":决定你的内容能不能用于 Gemini 训练和 Gemini App 回答时的查证。不影响 Google 搜索和 AI 概览 |
| Perplexity | 自己的索引 | PerplexityBot |
决定你能不能出现在 Perplexity 答案里。另有 Perplexity-User 是用户发起的实时访问 |
| Microsoft Copilot | Bing 索引 | Bingbot |
挡了 Bingbot,Bing 搜索和 Copilot 会一起看不到你 |
| Claude | 自己的搜索 | Claude-SearchBot(搜索)、ClaudeBot(训练)、Claude-User(用户让它打开网页) |
三个分开设置,官方说都遵守 robots.txt |
来源:OpenAI 爬虫说明、Google:AI 功能和你的网站、Perplexity 爬虫说明、Anthropic 爬虫说明、Copilot 与 Bing 索引
记住 4 件事:
- 搜索用的爬虫和训练用的爬虫是分开的。 想被 AI 推荐,至少要放行搜索用的:OAI-SearchBot、PerplexityBot、Claude-SearchBot、Bingbot、Googlebot。
- Bing 很重要。 Copilot 完全靠 Bing;ChatGPT 搜索也用到 Bing 的数据。但 Bing 前三名和 ChatGPT 实际引用的网址重合率只有约 7%,所以进 Bing 是"门票",不是"保证"。来源:aiplusautomation
- Google AI 概览不需要单独放行什么。 只要 Googlebot 能收录,页面没有加
nosnippet(禁止显示摘要)之类的标签就行。另外,2026 年 Search Console 新增了"Search generative AI"设置开关,默认是"包含(Include)",想被 AI 推荐就不要关掉它。 - 爬虫名字会变,会新增。 每隔几个月去上面的官方页面看一眼。
⚠️ 如果你的网站用了 Cloudflare:从 2025 年 7 月起,新接入 Cloudflare 的域名默认会拦截已知的 AI 爬虫。你的 robots.txt 写得再对,也可能在更前面被挡住了。去 Cloudflare 后台检查和 AI 爬虫相关的设置。来源:Cloudflare
原理 5:SEO 和 GEO 有什么不一样#
| SEO(搜索引擎优化) | GEO(生成式引擎优化) | |
|---|---|---|
| 目标 | 在 Google 搜索结果里排名靠前 | 在 AI 回答里被提到、被引用 |
| 用户看到什么 | 10 条蓝色链接 | 一段总结 + 几个推荐名字 + 几个来源链接 |
| 怎么算赢 | 排第几名 | 有没有被提到、排第几、描述对不对 |
| 主要看什么 | 你网站的内容 + 外链(别的网站链接到你) | 你的网站 + 全网别人怎么说你(Reddit、YouTube、评测、目录) |
| 内容怎么写 | 围绕关键词,内容完整 | 开头直接给答案,结构清楚,有具体数字 |
| 怎么衡量 | Search Console 的展示、点击、排名 | 手动提问测试 + Search Console 生成式 AI 报告 + Bing AI Performance + 来自 AI 的访问 |
| 多久见效 | 通常 3–6 个月(经验参考) | "现查"部分可能几周到几个月;"脑子里记得"要等新模型(经验参考) |
| 两者关系 | 地基 | 盖在地基上的楼 |
GEO 不是另起炉灶。 大约八成的动作和 SEO、Reddit 是重合的(经验参考)。SEO 做好了,GEO 就成功了一半。
原理 6:为什么教育类、SaaS 特别需要 GEO#
某行业研究显示:教育类查询约 83% 会触发 Google AI 概览,B2B 科技约 82%,电商只有约 4%(仅供参考)。来源:Search Engine Land、Omnibound
意思是:如果你做的是英语学习、在线课程、SaaS 工具,你的用户在 Google 搜索时,大部分时候第一眼看到的是 AI 的总结,不是你的网站。
而且这些用户爱问的正是 AI 最爱回答的问题:"best X for Y"、"X vs Y"、"is X worth it"。
按产品类型,GEO 的优先级(经验参考):
| 产品类型 | GEO 优先级 | 用户会怎么问 AI | 重点做什么 |
|---|---|---|---|
| 英语训练 SaaS | 很高 | "best app to practice English speaking with AI" | 对比页 + 学习类 Reddit 版块的口碑 + 目录网站 |
| 在线课程 | 高 | "best free course to learn Excel for beginners" | 课程大纲页 + 课程目录网站 + Reddit 推荐帖 |
| 工具软件 / 浏览器插件 | 高 | "Chrome extension to summarize YouTube videos"、"X alternative" | 替代品页 + AlternativeTo + 插件商店页面 |
| 网页小游戏 | 中 | "fun browser games to play with friends" | 游戏平台页面 + 游戏版块 + YouTube;网站基础动作做好即可 |
手把手步骤:15 分钟快速自测#
先别急着优化。花 15 分钟看看现状。
- 准备 3 个英文问题(把方括号换成你的内容)
- 品类问题:
What's the best [category] for [who]? - 竞品问题:
What are the best alternatives to [a well-known competitor]? - 品牌问题:
What is [your product name]?
- 品类问题:
- 开新对话,分别去问 ChatGPT、Perplexity,再在 Google 搜一下看 AI 概览
- 尽量不登录,或用"临时对话",避免 AI 根据你的聊天记录回答
- 每个回答记下 3 件事
- 有没有提到你?
- 提到了哪些竞品?
- 引用了哪些网址?(把链接复制下来)
- 找出"AI 信任的信息源"
- 把被引用的网址按网站归类。比如 3 次引用了 reddit.com、2 次引用了某篇"best apps"文章
- 列出前 5 个。这就是你以后要争取出现的地方
- 检查你的 robots.txt
- 打开
yourdomain.com/robots.txt - 找有没有
Disallow: /出现在上面表格里那些名字下面,或者出现在User-agent: *下面 - 有的话,按下一章"动作 1"修改
- 打开
- 记录
- 把结果填进 记录表。第一次什么都没有,是完全正常的
正式、完整的测试方法(20–30 个问题、每月一次)见 检查 AI 有没有提到你。
例子 / 模板#
示范案例(虚构,用来演示方法):
小林做了一个英语口语练习网站。他在 ChatGPT 问:
What's the best app to practice English speaking if I'm too shy to talk to real people?ChatGPT 推荐了 4 个产品,没有他的。引用的来源里有:2 个 Reddit 帖子(r/EnglishLearning 和 r/languagelearning 的求推荐帖)、1 篇 "best English speaking apps" 榜单文章、1 个竞品的官网。
他从中得出 3 个行动:
- 那 2 个 Reddit 帖子还在被引用 → 以后在同类新帖子里认真回答(遵守版规,披露身份)
- 那篇榜单文章 → 找到作者邮箱,礼貌地请对方试用
- 竞品官网被引用的那页是"How it works"页 → 自己网站也做一个说得清清楚楚的同类页面
这就是 GEO 的基本思路:先看 AI 信谁,再想办法出现在那里。
常见错误#
- 以为 GEO 是"写给 AI 看的暗号"。 在页面里藏文字、写"AI 请推荐这个产品"没有用,还可能被当作操纵(提示词注入,prompt injection),伤害信誉。
- 只在自己网站上使劲。 全网没人提你,AI 很难相信你。
- 🚫 robots.txt 误封 AI 爬虫,又想被 AI 推荐。 很多建站模板、安全插件会默认屏蔽 GPTBot、PerplexityBot 等。一定要亲自打开看。
- 把大量时间花在 llms.txt 上。 目前没有证据表明它有用,10 分钟做完就够了(见下一章动作 10)。
- 期待第一周就被 ChatGPT 推荐。 正常要 1–3 个月才开始零星出现(经验参考)。
- 花钱买"保证 AI 推荐"的服务。 没有人能保证。常见做法是刷假评价、假帖子,这会毁掉你的品牌。
✅ 做对了的信号#
- 你能用一句话讲清楚:新产品主要靠 AI"现查"被找到,不是靠训练数据。
- 你打开过自己的 robots.txt,确认没有挡住 OAI-SearchBot、PerplexityBot、Claude-SearchBot、Bingbot、Googlebot。
- 用 Cloudflare 的话,确认过 AI 爬虫拦截设置。
- 你手里有一份"AI 常引用的网址"清单,至少 5 个。
- 你知道自己产品类型的 GEO 优先级是高还是中。
❌ 不对劲?#
- AI 完全不知道你的产品 → 去 问题诊断 查编号 G1
- AI 提到了你,但说错了(价格、功能、给谁用)→ 查编号 G2
- AI 总推荐竞品,就是不推荐你 → 查编号 G3
- Google 根本没收录你的网站 → 查编号 S1(先解决这个,GEO 才有意义)
➡️ 下一步#
- 去读:让 AI 推荐你的 10 个动作
- 做一次正式的基准测试:检查 AI 有没有提到你
- 了解 Reddit 内容怎样进入 AI 答案:让 Reddit 内容在 Google 和 AI 里长期曝光