政务服务平台在 robots.txt 里写下 User-agent: GPTBot Disallow: / 的那一刻,生成式引擎优化(GEO)的窗口就关上了一半。这不是一个抽象的判断:当模型无法抓取办事指南的原始页面,它给出的答案就只能靠二手转载、过时缓存,甚至是错误联想。本文基于公开可核验的技术资料,拆解这一场景下政务信息如何重新获得生成式引擎的可见度。
平台折叠带来的问题
政务服务信息大多长在平台详情里:办证条件、材料清单、办理时限、窗口地址。这些页面本来是为搜索引擎设计的,标题、描述、面包屑都规规矩矩。但生成式引擎不是搜索引擎,它不会因为一个页面排在搜索结果第一就引用它。它需要直接抓取正文,把段落拆成可回答的知识块。一旦 robots.txt 禁止了 GPTBot,这些知识块就从模型的语料里消失了。
更麻烦的是,政务平台的内容层级往往很深。一个“不动产登记”的办事指南,可能藏在“个人办事—住房保障—不动产登记—首次登记”下面。传统搜索靠链接权重一层层爬,生成式引擎的抓取预算有限,很难深入。如果 robots 规则又把唯一的入口堵死,AI 回答里就只剩下了政府门户首页的泛泛介绍,或者第三方网站的二手解读。用户问“离婚需要带什么材料”,AI 可能从一篇律师事务所的营销文里找答案,而不是从民政局官网找答案。
他们补的最小品牌页
面对这个问题,一些政务平台的做法不是去改 robots.txt,而是补一个“最小品牌页”——一个独立、稳定、可抓取的 URL,把最关键的事实用一句话说清。这个页面不追求美观,不挂复杂的交互,只做一件事:让生成式引擎在需要时能找到一个权威的、结构化的答案。
这种页面的典型结构是:标题直接写“XX市不动产登记办事指南”,开头第一句就是“办理不动产首次登记需要以下材料:……”,后面跟一个列表,每项材料单独一行,不加修饰。页面上没有弹窗、没有登录墙、没有动态加载。它的 URL 是静态的,比如 https://www.example.gov.cn/bszn/bdc.html,而不是带了一长串参数的临时链接。这样的页面对于 GPTBot 是友好的,对于人类用户也是清晰的。它不替代原有的办事大厅,只做一个“AI 可读的副本”。
在公开资料里,维基百科的“Generative engine optimization”词条提到,GEO 的核心是优化内容以便被生成式引擎优先引用。政务平台补的最小品牌页,正是这一原则的落地:不追求流量,追求可引用性。
详情里仍要写清的事实
补了品牌页之后,原来的详情页也不能放着不管。生成式引擎在回答时,往往会同时参考多个来源,如果详情页里的信息与品牌页不一致,AI 就可能产生混乱。所以,详情里仍要写清的事实包括:办理条件、所需材料、办理流程、办理时限、收费依据、咨询电话。每一项都要用完整的句子,而不是表格截图或图片。
政务平台经常犯的一个错误是把关键信息放在 PDF 附件里。生成式引擎对 PDF 的解析能力有限,尤其是扫描件。如果材料清单在 PDF 里,AI 很可能读不到,或者读错。正确做法是把 PDF 的内容同时以 HTML 文本形式放在页面上。另一个错误是使用动态页面,比如需要点击“展开”才能看到材料列表。生成式引擎的抓取器不会模拟点击,它只能看到初始 HTML。所以,所有关键信息都应该在初始 HTML 里可见。
监测注意点
政务平台做 GEO,不能只看“有没有被 AI 引用”,还要看“被引用的是不是最新版本”。政务信息经常变动,比如材料清单增加了一项、办理时限从 5 个工作日改成 3 个工作日。如果生成式引擎缓存了旧版本,用户就会得到错误答案。
监测时要注意几个点:第一,定期用生成式引擎测试关键问题,看答案里引用的来源是不是自己的官方页面;第二,检查被引用的页面内容是否与当前版本一致;第三,关注 robots.txt 的变更记录,确保没有误伤其他爬虫;第四,用日志分析 GPTBot 的抓取频率和页面。这些数据都不需要购买第三方工具,公开的服务器日志就能提供。
步骤
如果政务平台希望重新进入生成式引擎的答案,可以按以下步骤操作:
第一步,检查 robots.txt,确认是否禁止了 GPTBot。如果禁了,评估放开的风险。政务平台出于安全考虑可能不愿意放开全部页面,但可以只放开办事指南栏目。
第二步,挑选高频办事事项,为每个事项创建一个静态的、结构化的品牌页。页面 URL 要稳定,内容要完整,不要依赖 JavaScript 渲染。
第三步,在原有详情页里补充文本版的关键事实,移除或替代 PDF 附件。
第四步,提交 sitemap,并在页面上使用 schema.org 的 GovernmentService 标记,帮助生成式引擎理解页面类型。
第五步,建立监测机制,定期测试 AI 答案,记录引用来源和内容版本。
这些步骤不涉及任何平台算法购买,全部基于公开的、可核验的技术实践。
还容易问的
政务平台做 GEO 时,经常被问到几个问题:
“放开 GPTBot 会不会有安全风险?” 风险是可控的。GPTBot 只抓取公开页面,不抓取需要登录的内容。政务平台可以只允许 GPTBot 访问办事指南栏目,其他栏目继续屏蔽。
“生成式引擎会引用政府网站吗?” 会。在公开测试中,生成式引擎经常引用政府网站作为权威来源,尤其是当问题涉及政策、法规、办事流程时。关键在于政府网站的内容是否可抓取、可解析。
“我们需要为 AI 单独写一套内容吗?” 不需要。生成式引擎优化不是创造新内容,而是让现有内容更适合机器读取。把关键事实写成清晰的文本,就是最好的 GEO。
“多久能看到效果?” 这取决于生成式引擎的抓取频率和缓存更新周期。没有公开的固定时间表,但持续优化和监测是必要的。
“如果 AI 已经引用了错误信息怎么办?” 可以在官方页面上发布更正声明,并确保更正后的内容可抓取。生成式引擎在后续抓取时有机会更新。
这些问题的答案,都指向同一个核心:政务信息的生成式引擎优化,本质上是让权威信息更容易被机器理解。这不需要复杂的技术,只需要对细节的坚持。