律师法务网站被 AI 引用的前提,不是文笔更好,而是机器能稳定读到你的实体信息和问答结构。很多律所官网内容完整,但 Schema.org 标记缺失或错位,导致生成式引擎只抓取到零散文字,无法形成可引用的事实片段。下面这张表可以直接用于内部排查。

先声明这张表查什么

这张表查两件事:一是网站是否允许生成式引擎抓取,二是结构化数据是否标记了 AI 最需要的字段。查完能回答一个问题:当用户问“离婚冷静期怎么算”“试用期被辞退有赔偿吗”,你的页面有没有可能被 AI 选为来源。

不查文采,不查律师资历,只查机器可读性。

必查项

检查项是否通过不通过时的动作
robots.txt 是否允许 GPTBot、PerplexityBot、ClaudeBot 等生成式引擎爬虫是/否在 robots.txt 中删除对这些 User-agent 的禁止规则,或添加 Allow 指令
网站是否有 XML sitemap,且包含 FAQ 页、律师介绍页、服务领域页是/否生成或更新 sitemap.xml,提交到 Google Search Console 和 Bing Webmaster Tools
每个律师页面是否使用 Organization 或 Person 的 Schema 标记,并包含 name、url、address、telephone是/否在律师介绍页添加 JSON-LD,至少包含律师姓名、所属律所、执业证号(如有公开信息)、办公地址、电话
律所首页是否使用 LegalService 或 Attorney 类型的 Schema,并链接到各律师页面是/否添加 LegalService 的 JSON-LD,使用 employee 或 founder 属性关联律师实体
每个常见法律问题是否有独立 URL,且页面内使用 FAQPage Schema 标记问与答是/否为高频法律咨询建立独立页面,每页一个主问题,用 FAQPage 输出问答对
FAQ 内容是否直接给出可执行结论,而不是“建议咨询律师”是/否改写答案,先给结论(如“试用期被辞退是否赔偿,取决于是否属于违法解除”),再列条件
HowTo 或步骤类内容(如“如何申请劳动仲裁”)是否使用 HowTo Schema,并拆解为清晰的步骤是/否把流程内容改为 HowTo 标记,每步包含名称、描述、顺序
所有 Schema 标记是否通过 Google 富媒体结果测试或 Schema.org 验证器是/否使用验证工具检查,修复错误和警告
页面正文是否包含日期和“数据截止”声明,且 Schema 中 dateModified 与实际一致是/否在正文末尾加“最后更新于 YYYY-MM-DD”,并在 JSON-LD 中同步 dateModified
网站是否开放了关键页面给所有爬虫(无登录墙、无 IP 屏蔽)是/否检查服务器防火墙和 CDN 规则,确保搜索引擎和生成式引擎爬虫能访问

加分项

  • 在页面内链接到权威法律来源(如 gov.cn、法院公告、司法解释),并保持链接可打开。
  • 为同一法律问题制作多角度解释,但每个页面只聚焦一个主问题,避免信息混杂。
  • 使用 speakable Schema 标记适合语音搜索的答案段落。
  • 在律所介绍页添加 sameAs 链接到官方社交媒体或行业名录,增强实体一致性。
  • 为重要法律问题提供“短答案”摘要,放在页面顶部,方便 AI 直接提取。
  • 定期更新法律条文引用,确保没有失效链接或过期版本。

怎么记结果

  1. 打印这张表,或复制到在线表格。
  2. 每检查一项,在“是否通过”列填写“是”或“否”。
  3. 对于“否”的项,记录问题 URL 和具体错误信息。
  4. 按“不及格先修哪三项”中的优先级排序修复任务。
  5. 修复后重新验证,并用“是”更新表格。
  6. 每季度重查一次,因为生成式引擎的抓取规则和 Schema 标准会更新。

不及格先修哪三项

  1. 先修 robots.txt 抓取权限。没有抓取,后面所有优化都无效。检查是否屏蔽了 GPTBot 等爬虫,并加入允许规则。
  2. 再修 Organization 和 LegalService Schema。让 AI 知道你是谁、在哪、提供什么服务,这是被引用的基础实体信息。
  3. 最后修 FAQPage 和 HowTo Schema。把常见法律问题结构化,提供明确、可核验的答案,AI 才能从你的页面提取引用片段。

这三项修完,基本能解决 80% 的“不被引用”问题。其余加分项可以后续迭代。

还容易问的

见下方 FAQ 部分。更多关于 GEO 与 SEO 的区别,可参考 SEO 与 GEO 的关系。想了解整体优化框架,见 GEO 指南