一个做跨境健身器材的团队发现:用英文在 ChatGPT Search 里问「best resistance bands for home workouts」,弹出的推荐清单里全是欧美品牌,自己官网的产品页根本没被提及。但同样的产品,在传统 Google 搜索里还能排到前两页。问题出在哪?不是产品不行,而是官网没有为生成式引擎做准备——英文页面太少、GPTBot 被 robots.txt 挡在外面、训练装备页既没有结构化数据也没有可引用的结论。
这个坑每天都在发生
健身行业出海时,最常见的一个现场是:英文站做好了,产品图也上传了,但 ChatGPT Search、Perplexity 这类 AI 引擎在回答「best adjustable dumbbells for beginners」时,引用的是 Amazon 列表、YouTube 测评、或者某个大媒体的 roundup,而不是你的官网。运营团队打开抓取日志会发现:GPTBot 根本没来过,或者来了只抓了首页,产品页和训练指南页全被忽略。
有些团队会误以为「英文内容少」是主因,于是大量翻译中文页面。但翻译出来的页面往往没有回答用户真正在问的问题。比如,用户问「can I do strength training with resistance bands only?」你的页面如果只是产品参数(材质、尺寸、重量),没有给出「可以,但需要配合渐进式负荷,建议从 X 磅开始,每周 3 次」这样的结论,AI 就没法引用你。生成式引擎要的是能直接放进答案里的句子,不是参数表。
另一个坑是 robots.txt 里仍然写着 User-agent: GPTBot Disallow: /。很多网站在 2023 年为了「保护内容」屏蔽了 AI 爬虫,结果到了 2025 年,发现 ChatGPT Search 里完全搜不到自己。AI 引擎读不到你的页面,自然不可能引用你。
它会怎样把线索截走
当境外用户在 ChatGPT Search 里问「what is the best home gym equipment for small spaces」,AI 给出的答案会直接列出 3-5 个具体品牌和产品,并附上理由。如果你的品牌不在其中,用户就会点击那些被推荐的链接,或者直接去 Amazon 搜索那些品牌。你的官网连被比较的机会都没有。
更麻烦的是,AI 的答案具有「固化效应」。一旦某个品牌在某一类问题里被反复引用,后续用户再问类似问题时,AI 倾向于沿用之前的来源。如果你一开始没进去,后面想挤进去的成本会越来越高。而且,生成式引擎的推荐往往直接给出购买建议,用户不需要再打开一堆网页对比,这比传统搜索的「点击-浏览-比较」路径更短,截走线索的速度也更快。
对于健身机构(比如健身房、瑜伽馆)来说,如果英文用户问「best gyms in [city] with personal training」,而你的官网没有英文页面、没有结构化数据标记地址和课程、没有在本地实体信息上保持一致,AI 就可能在回答里把你写成另一家,或者干脆不提你。线下到店的线索同样会被截走。
解法不是再买流量
很多团队的第一反应是加大 Google Ads 投放,或者找网红做测评。但问题是:用户在 ChatGPT Search 里提问时,根本不看广告。买流量解决不了「AI 不引用你」的问题。真正的解法是把官网改造成生成式引擎愿意引用的样子。这包括三件事:
- 放行 GPTBot:在 robots.txt 里允许 GPTBot 抓取你的页面,同时确保服务器能正常响应。
- 建立英文常青页:针对高频英文问题,比如「best home gym equipment for small spaces」「can you build muscle with resistance bands」「how to choose adjustable dumbbells」,写出直接回答问题的英文页面。每个页面要有明确的结论、可引用的句子、以及作者和更新日期。
- 补结构化数据:用 Schema.org 标记产品、FAQ、组织信息,让 AI 能准确理解你的页面内容。
这不是再买流量,而是把已有的官网资产变成 AI 能读懂、敢引用的内容。
GEO 落地的动作
第一步:检查 robots.txt。用 curl https://你的域名/robots.txt 查看是否有 User-agent: GPTBot 和 Disallow。如果没有,就加上:
User-agent: GPTBot
Allow: /
同时,在 Google Search Console 里查看「设置-抓取统计」里 GPTBot 的抓取情况。如果 GPTBot 来了但只抓了首页,说明内部链接不够,需要从首页链到重要的英文产品页和指南页。
第二步:找英文高频问题。用工具(比如 Google Keyword Planner、AnswerThePublic、或者直接看 ChatGPT Search 的推荐问题)列出你的目标市场用户最常问的 20 个英文问题。比如:
- best adjustable dumbbells for beginners
- can you build muscle with resistance bands
- how to choose a yoga mat for hardwood floors
- best home gym equipment for small spaces
- is a treadmill or elliptical better for weight loss
第三步:为每个问题建立一个英文常青页。页面标题直接包含问题,H1 用自然语言回答,第一段就给出明确结论。例如:
Yes, you can build muscle with resistance bands, but you need to use progressive overload by increasing resistance or repetitions over time. A good starting point is a set of bands with 10-50 lbs of resistance, used 3 times per week.
这样的句子可以直接被 AI 引用。页面里还要有「作者」和「最后更新日期」,因为生成式引擎倾向于引用有明确责任人和新鲜度的内容。
第四步:加结构化数据。产品页用 Product schema,FAQ 页用 FAQPage schema,组织信息用 Organization schema。特别是 FAQ 页,用 JSON-LD 标记问题和答案,能让 AI 更容易抽取。
第五步:内部链接。从首页、产品分类页、博客文章链接到这些英文常青页,让 GPTBot 能顺着链接抓取到所有重要页面。
验收口径
不要指望一夜之间就被 ChatGPT Search 引用。设定一个 4-6 周的观察期,每周检查以下指标:
| 指标 | 怎么查 | 合格线(参考) |
|---|---|---|
| GPTBot 抓取量 | 服务器日志或 Google Search Console | 每周至少抓取 20 个英文页面 |
| 英文页面收录 | 在 ChatGPT Search 里输入 site:你的域名 | 能看到 5 个以上英文页面 |
| 引用出现次数 | 在 ChatGPT Search 里问目标问题,看答案里是否出现你的品牌 | 3 个核心问题里至少有 1 个出现 |
| 点击来源 | 网站分析工具里看 referral 来源是否出现 chatgpt.com 或 perplexity.ai | 出现来自 AI 引擎的点击 |
如果 4 周后 GPTBot 抓取量还是零,检查 robots.txt 和服务器防火墙;如果抓取了但没被引用,检查页面内容是否直接回答了问题、是否有可引用的结论。
还容易问的
很多团队会问:是不是所有页面都要做成英文?不需要。先聚焦在最能带来海外线索的 10-20 个核心问题页。中文页面继续保留,但英文页面的 URL 要独立,不要用自动翻译插件生成,因为翻译质量差的话 AI 不敢引用。
还有人问:要不要花钱找第三方做 GEO 优化?如果你内部有 SEO 人员,完全可以自己做。GEO 的基础动作——放行爬虫、写常青页、加结构化数据——和 SEO 有大量重叠。关键是理解生成式引擎的引用逻辑:它要的是能直接放进答案里的、有明确结论的内容。