群众在生成式搜索里问“新生儿医保怎么办”“失业金怎么领”,答案往往来自第三方聚合平台,而不是政务服务官网。官网的办事指南页明明存在,却总被AI忽略。问题通常不在权威性,而在步骤文档的呈现方式:AI抓不到、读不懂、不敢引用。
政务服务的“怎么办”类页面,本质上是一份步骤文档。它需要同时满足群众阅读和机器解析两种需求。本文不讨论理论模型,只从政务服务一线执行者的角度,拆解如何把一份已有的办事指南改造成AI敢引用的常青页。
问题是什么
政务服务官网的办事指南页通常存在三类缺陷,导致生成式引擎无法引用。
第一,步骤信息不完整。许多页面只写了“办理条件”“办理材料”,但缺少从申请到办结的完整流程。AI在生成答案时,需要知道“下一步做什么”,页面没有提供,AI只能引用聚合平台的信息。
第二,格式不利于机器解析。政务页面大量使用表格、流程图,但缺少结构化数据标记。AI爬虫可以读取文字,却难以理解步骤之间的逻辑关系。例如,一个包含“第一步、第二步”的段落,AI无法确定这是顺序步骤还是并列选项。
第三,可抓取性不足。部分政务网站在robots.txt中屏蔽了GPTBot等AI爬虫,或者页面需要登录才能访问。AI根本读不到内容,自然无法引用。
这些问题的核心是:政务网站习惯了“我发布,你来看”的模式,而生成式引擎需要“我提供,你重组”的素材。步骤文档必须从“展示型”转向“可引用型”。
如何解决
解决思路并不复杂:把步骤文档当作数据源来建设,而不是当作公告来发布。
首先,补齐步骤链条。任何一项政务服务,都应该能回答“从哪开始、经过哪些环节、到哪结束”。例如,“申请公租房”至少应包括:资格自查、材料准备、线上/线下提交、审核、公示、轮候、选房、签约。每一步都需要明确的动作和预期结果。
其次,使用语义化HTML和结构化数据。将步骤用<ol>有序列表呈现,并在<head>中加入HowTo或FAQPage的Schema标记。这样AI可以明确识别“这是一份步骤指南”,并提取每一步的文本。
最后,确保AI能抓取。检查robots.txt,允许GPTBot、PerplexityBot等主流AI爬虫访问指南页。同时,页面不应有强制登录或验证码。
这些措施不需要推翻现有网站架构,可以在现有CMS上逐步实施。
用GEO如何解决
GEO(生成式引擎优化)关注的是如何让内容在AI生成的答案中被引用。对于政务服务步骤文档,GEO的落地可以概括为三个动作:结构化、实体对齐、引用友好。
结构化:除了HTML语义标签,还应在页面中提供清晰的小标题。例如,使用<h3>区分“线上办理步骤”和“线下办理步骤”,使用<table>列出材料清单。AI更容易从结构化的内容中提取要点。
实体对齐:政务服务涉及大量实体,如“XX市社保局”“XX区政务服务中心”。这些名称在不同页面、不同公告中可能存在差异(如“社保局”与“人力资源和社会保障局”)。AI会将不同名称视为不同实体,导致信息割裂。应统一使用官方全称,并在页面中提供别名说明。
引用友好:AI倾向于引用简洁、明确的句子。步骤描述应避免长从句和模糊表述。例如,“携带身份证原件及复印件到户籍所在地街道办提交申请”比“请申请人根据相关规定前往指定地点办理”更易被引用。
此外,GEO还强调“被引用的概率”。如果多个权威来源提供相同信息,AI更可能引用其中结构最清晰、最易提取的那个。政务官网应成为那个“最易提取”的来源。
操作步骤
以下操作步骤以一份“新生儿医保参保”办事指南为例,演示从现状检查到验证的完整过程。执行者可以是政务服务网站编辑、信息化部门工作人员或外包运维团队。
- 打开目标页面:登录政务网站后台,找到“新生儿医保参保”办事指南页。记录当前URL和页面标题。
- 检查robots.txt:在浏览器输入
https://你的政务域名/robots.txt,查看是否包含User-agent: GPTBot或User-agent: *的Disallow规则。如果屏蔽了GPTBot,在robots.txt中添加:
同时允许PerplexityBot等其他AI爬虫。User-agent: GPTBot Allow: / - 整理步骤清单:对照现有指南,列出从“申请条件”到“完成参保”的全部步骤。如果缺失,参考上级部门发布的规范性文件补全。例如,“新生儿医保参保”应包括:①新生儿出生登记;②准备材料(出生证明、户口本、父母身份证);③线上或线下提交;④审核;⑤缴费;⑥领取医保卡。
- 重写步骤文本:将每一步写成“动作+对象+条件”的句式。例如,将“申请人需提交相关材料”改为“携带新生儿出生证明、户口本原件及复印件、父母双方身份证原件及复印件,到户籍所在地街道(乡镇)医保服务窗口提交”。
- 使用语义化HTML:在页面模板中,将步骤列表放入
<ol>标签,每个步骤用<li>包裹。不要用<div>或<br>模拟列表。 - 添加结构化数据:在页面
<head>区域插入HowTo类型的JSON-LD。示例:
确保JSON-LD中的文本与页面可见文本一致。<script type="application/ld+json"> { "@context": "https://schema.org", "@type": "HowTo", "name": "新生儿医保参保办理步骤", "step": [ {"@type": "HowToStep", "name": "准备材料", "text": "携带新生儿出生证明、户口本原件及复印件、父母双方身份证原件及复印件。"}, {"@type": "HowToStep", "name": "提交申请", "text": "到户籍所在地街道(乡镇)医保服务窗口提交材料。"} ] } </script> - 统一实体名称:检查页面中出现的机构名称,如“医保局”“社保局”“人社局”。统一为官方全称,并在首次出现时注明简称。例如,“XX市医疗保障局(以下简称市医保局)”。
- 添加FAQ区块:在页面底部增加常见问题,如“新生儿医保可以线上办理吗?”“缴费标准是多少?”,使用
FAQPageSchema标记。这能提高页面被AI直接引用为答案的概率。 - 优化标题和描述:将页面
<title>改为包含具体服务名称和动作的短语,如“新生儿医保参保办理步骤 - XX市医疗保障局”。<meta name="description">写一句包含关键步骤的摘要。 - 提交站点地图:在网站根目录的
sitemap.xml中加入该页面的<url>条目,并更新lastmod为当天日期。 - 用AI工具测试抓取:使用OpenAI的
gptbot模拟工具或第三方GEO检测工具,提交页面URL,查看AI是否能返回步骤摘要。如果返回空,检查robots.txt和页面渲染是否正常。 - 第二天复查:第二天再次用AI工具测试,并检查网站日志中是否有GPTBot的访问记录。同时,在主流生成式搜索中提问“新生儿医保怎么办”,观察是否出现官网链接或引述。
以上步骤中,第2、6、11、12条是关键控制点,直接影响AI能否抓取和引用。其余步骤是内容基础。
做完如何验收
验收分三个层面:技术可抓取、内容可提取、引用可发生。
技术可抓取:robots.txt已允许GPTBot;页面无强制登录;在网站日志中能看到GPTBot的抓取记录。
内容可提取:用结构化数据测试工具(如Google Rich Results Test)验证HowTo Schema无误;在浏览器中查看页面源代码,<ol>列表完整,JSON-LD脚本存在。
引用可发生:在至少两个生成式引擎(如ChatGPT、Perplexity)中提问相关服务,观察答案是否包含官网的步骤文本或链接。由于AI生成具有随机性,建议连续三天提问,记录引用情况。
如果以上三点均达标,说明该步骤文档已具备被AI引用的基础条件。后续维护重点是更新时效性信息(如材料变更、流程调整),并保持结构化数据同步。
还容易问的
以下问题来自政务网站运维人员和内容编辑的常见困惑。
问:我们的办事指南页有大量表格,AI能读取表格吗?
AI可以读取HTML表格,但表格中的步骤关系可能丢失。建议将步骤性内容改用有序列表呈现,材料清单等数据保留表格,并添加Table类型的Schema标记。
问:政务网站需要登录才能查看指南,会影响AI抓取吗?
会。任何形式的强制登录都会阻止AI爬虫访问。建议将办事指南类页面设为公开,仅对个人办事记录等隐私内容保留登录。
问:步骤文档需要多久更新一次?
只要政策或流程发生变化,就应立即更新。同时,在页面中标注“最后更新时间”,AI会倾向于引用时效性明确的内容。
问:如何知道AI是否引用了我们的页面?
可以通过生成式引擎的引用标注查看(如Perplexity会显示来源),也可以在网站日志中观察AI爬虫的访问频率。另外,一些第三方SEO工具开始提供AI引用监测功能。
问:GEO和传统SEO有什么不同?
传统SEO关注关键词排名和点击量,GEO关注内容是否被AI引用并重组。政务服务步骤文档更需要GEO,因为群众的目标是“得到可执行的答案”,而不是“访问某个网页”。