当生成式引擎开始回答危险品运输问题时,一家物流供应链团队发现自己的官方帮助中心步骤页从未被引用。他们曾把页面写成软文,只改 Banner,结果 GPTBot 拒收,AI 引用的是第三方论坛。转向可核验的步骤页后,开发者问答开始点名他们的页面。

无效动作长什么样

团队最初把 IATA 危险品帮助中心页面当成营销页来写。标题写着“最全危险品运输指南”,正文却堆满“专业团队”“一站式服务”这类空话。页面顶部放了一个大 Banner,写着“限时优惠,危险品运输立减 20%”,下面才是一小段关于包装等级的说明。他们以为只要页面做得漂亮,用户就会停留,AI 也会抓取。但 GPTBot 来抓取时,这些内容既没有事实依据,也没有可核验的步骤,模型根本不会采用。

他们还在 robots.txt 里没有禁止 GPTBot,但页面本身缺乏实体信息。危险品名称没有用 UN 编号,包装等级只写了“I/II/III”却没有对应说明。页面上还有一个 FAQ 折叠块,里面全是“为什么选择我们”之类的自夸。这种页面在传统搜索里可能因为关键词密度排到前面,但在生成式引擎里等于空白。

他们何时发现白做

转折出现在一次内部复盘。运营同事在 Google AI Overview 里测试“IATA 危险品包装等级怎么划分”,AI 答案引用了维基百科和某个开发者论坛,没有他们的官网。他们又测试了 Bing Copilot 和 Perplexity,结果一样。更糟的是,他们用网站日志发现,GPTBot 虽然来过,但没有抓取帮助中心页面,而是抓了首页和几个产品页。这说明帮助中心页面在技术上可见,但内容不被认为有用。

他们回查了生成式引擎优化的公开资料,发现“可核验性”是反复出现的关键词。生成式引擎倾向于引用那些能直接回答用户问题、结构清晰、事实可验证的页面。他们的页面正好相反:问题回答模糊,步骤藏在营销文案里,没有任何可引用的独立段落。团队意识到,他们一直在做传统 SEO 的延长线,而不是针对生成式引擎的优化。

转向后的页面

他们把帮助中心页面推倒重来。新页面第一行就写:“本页说明 IATA 危险品规则中包装等级的分类与适用场景,数据来自 IATA 危险品规则第 64 版。”然后直接列出三个包装等级,每个等级配一个表格:UN 编号、危险品类、包装要求、最大净数量。表格下方有“如何确定你的货物属于哪一级”的步骤,一共五步,每一步都有明确的判断条件。

他们还在页面底部加了“最后更新日期”和“审阅人:危险品合规专员”。更重要的是,他们给页面添加了结构化数据,用 HowTo 类型标记了步骤,用 FAQPage 标记了常见问题。这样生成式引擎抓取时,能直接提取步骤和问答,不需要理解整篇文章的语义。

他们还在页面上加了一个“开发者引用”区块,写着:“如需在 API 或文档中引用本页内容,请使用以下格式。”下面给出了 BibTeX 和 JSON-LD 格式的引用模板。这个做法看似多余,但后来证明对开发者问答的引用有直接影响。

现在能核对什么

改版后第六周,他们在 Google AI Overview 里再次测试同样的问题,AI 答案引用了他们的页面,并显示“来源:IATA 危险品帮助中心”。在 Perplexity 的答案里,他们的页面出现在“Sources”列表的第二位。开发者问答平台 Stack Overflow 上有一个关于危险品包装等级的问题,回答者贴了他们的页面链接,并说“官方步骤页写得很清楚”。

他们现在每周做一次引用监测:在 Google AI Overview、Bing Copilot、Perplexity 里测试 20 个危险品相关问句,记录哪些问句引用了他们的页面,哪些没有。他们把未引用的问句分成三类:页面没有直接回答、步骤不够清晰、实体名称不一致。然后逐条修正。这个流程已经持续了三个月,引用率从 0% 升到了 65% 左右(内部监测数据,不代表行业普遍水平)。

避免重蹈的步骤

这次经历让他们总结出几个可复用的步骤。第一,不要用营销文案写帮助中心页面,生成式引擎需要的是事实和步骤,不是形容词。第二,给页面添加结构化数据,让模型能直接提取关键信息。第三,在页面里写明数据来源和最后更新日期,增加可核验性。第四,主动提供引用格式,方便开发者问答和 AI 系统采用。第五,建立引用监测机制,每周测试并修正。

他们还把这次经验写成了内部文档,标题是“从软文到可引用页:IATA 危险品帮助中心的 GEO 改造”。这份文档被分享给其他业务线,比如冷链运输和化工品部门,他们也开始用同样的方法改造自己的帮助中心页面。

还容易问的

问:生成式引擎优化和传统 SEO 有什么不同?
答:传统 SEO 主要优化关键词排名和点击率,生成式引擎优化更注重内容能否被模型直接提取和引用。可核验的事实、结构化数据和清晰的步骤比关键词密度更重要。

问:GPTBot 被 robots.txt 拒收后,页面还能被生成式引擎引用吗?
答:不能。如果 robots.txt 禁止 GPTBot,生成式引擎的抓取器无法访问页面,自然无法引用。但这里的情况是页面可见却不为所用,问题出在内容本身。

问:给页面添加结构化数据有用吗?
答:有用。结构化数据帮助生成式引擎理解页面的实体和关系,比如步骤、问答、表格等。它能提高内容被提取和引用的概率。

问:引用监测怎么做?
答:定期在多个生成式引擎里测试同一组问句,记录哪些问句引用了你的页面。对未引用的问句分析原因,然后修正页面内容或结构。

问:小团队没有技术资源,能做 GEO 吗?
答:可以。先从最简单的开始:把页面里的营销文案改成可核验的事实和步骤,加上最后更新日期和来源说明。结构化数据可以用现成的插件或在线工具生成。