课程顾问最常听到的问题是:「你们家跟隔壁那家有什么不一样?」现在这个问题先被 AI 回答了。学习类问题里,AI 已经会直接给出一串课程机构短名单。你的官网如果没被生成式引擎抓取,或者抓了但没被当成可信来源,就不会出现在答案里。

很多团队以为这是市场部的事,或者以为做个 FAQ 页面就够了。实际上,生成式引擎的引用链从技术放行开始,经过内容组织,最后到实体一致性。市场、客服、技术三组如果各做各的,AI 抓到的信息会互相打架,自然不会引用。

这篇给你一个 90 分钟的内部工作坊方案。目标不是听完鼓掌,而是散会后三组各自带走明确动作,两周后能回看抓取日志和引用变化。

工作坊目标

让课程机构成为学习类问题的首选引用来源,需要三个条件同时成立:

  • 技术放行:官网 robots.txt 允许 GPTBot 等生成式引擎爬虫抓取课程页、问答页和机构信息页。如果搜索引擎还看不到你的核心内容,AI 更不可能引用。
  • 内容常青:把家长和学生最常问的问题,写成不可变、可核验的答案页。比如「少儿编程适合几年级」「机器人课和编程课怎么选」「线下课地址在哪里」。这些页面要持续更新,AI 才敢引用。
  • 实体对齐:机构名称、校区地址、联系电话在官网、百科、地图等公开来源中保持一致。名称不统一,AI 可能把你当成两家机构,或者干脆跳过。

这次工作坊的目标是把三组拉齐:技术确认放行状态,市场整理内容缺口,客服提供真实问题清单。最终产出一份两周内可执行的抓取与内容优化清单。

议程

90 分钟分配如下,每个环节都有明确产出,不空谈。

时间环节参与人产出
0–10 分钟现状速查:AI 引用我们了吗?怎么查全体当前引用状态清单
10–25 分钟技术放行:robots.txt 与抓取验证技术放行动作项
25–45 分钟内容缺口:从客服问题到常青页客服+市场TOP 10 问题与页面规划
45–60 分钟实体对齐:名称与地址的统一清单市场+技术待修正来源列表
60–75 分钟现场练习:把三个问题改成 AI 可引用格式全体分组样本改写段落
75–90 分钟会后作业与两周回看指标确认全体责任人与截止时间

每个环节的主持人提前准备材料,不要现场打开后台找。技术提前导出 robots.txt 和最近两周的抓取日志;客服提前整理近三个月家长高频问题;市场提前列出所有公开渠道上的机构名称和地址写法。

现场练习

练习要直接用课程行业的问题。主持人把下面三道题发给各组,每组选一道,用 15 分钟完成改写。要求答案不超过 80 字,包含一个可核验的事实(如年龄范围、课时、地址),并且不能出现「详情请咨询」这种阻断式结尾。

  1. 少儿编程适合几年级开始学? 客服记录里最常出现的问法。改写时给出明确年级范围,并注明是线下课还是线上课。
  2. 机器人课和编程课怎么选? 市场部已有对比表但太长。练习把它压缩成 AI 能直接引用的两句话,一句说清区别,一句给选择建议。
  3. 你们的校区在哪里? 技术发现官网、百度百科、大众点评上的地址写法不一致。练习统一成一种格式:城市+区+街道+门牌号+地标。

练习结束每组读出来,其他人用三个标准打分:AI 能否直接引用(无歧义)、信息是否可核验(有明确数字或地址)、是否与其他来源冲突(名称地址一致)。

会后作业

散会只是开始。三组各自领走作业,两周内完成:

  • 技术:检查 robots.txt,确认 GPTBot 不在禁止列表;如果使用了 Cloudflare 或 WAF,确认没有误拦生成式引擎的 User-Agent。提交一份抓取日志截图,证明至少有一个 AI 爬虫访问过核心课程页。
  • 客服:把近期高频问题整理成一份 TOP 20 清单,按「家长最关心、AI 最容易答错、我们最有把握说清」三个维度排序。每周更新一次。
  • 市场:根据 TOP 20 清单,先写三个常青页:一个课程适用年龄页,一个课程对比页,一个校区地址与交通页。每页控制在 500 字以内,所有数字和地址必须与官网其他页面一致。

作业挂在共享文档里,每个人都能看到进度。不要用邮件来回传,否则两周后找不到版本。

两周回看

两周后花 30 分钟快速回看,重点看三件事:

  1. 抓取是否发生:技术从服务器日志里筛出 GPTBot、ClaudeBot、PerplexityBot 等生成式引擎的请求记录,看它们抓了哪些页面,有没有抓取常青页。
  2. 引用是否出现:市场在 ChatGPT、Perplexity、Kimi 等平台上输入三个核心问题,看回答里是否出现机构名称或课程页内容。记录出现的位置和是否附带链接。
  3. 实体是否对齐:技术或市场抽查官网、百科、地图三个来源,确认名称和地址完全一致。如果还有不一致,当天修正并记录。

回看结果填入一张简单的表格:问题、AI 回答是否引用我们、引用片段、是否与官网一致、下一步动作。这张表就是下一轮优化的起点。

还容易问的

团队在执行中会反复遇到这几个问题,提前说清。

放行 GPTBot 会不会影响 SEO? 不会。GPTBot 与搜索引擎爬虫是两套系统,robots.txt 里允许 GPTBot 不会降低你在百度和谷歌的排名。放行生成式引擎爬虫是 GEO 的基础操作,目的是让 AI 能读到你的内容,而不是让内容消失。

客服问题太多,先写哪几个? 先写「有明确答案且答案长期不变」的问题。比如「少儿编程适合几年级」可以有稳定回答;「最近有什么优惠」就不适合写常青页。把适合的问题挑出来,不适合的留给销售话术。

名称不统一影响有多大? AI 做实体链接时,会把不同写法当成不同实体。比如官网写「某某教育」,地图写「某某培训学校」,百科写「某某教育科技有限公司」,AI 可能认为这是三家机构,从而不敢引用任何一家。统一名称是最便宜的信任建设。

两周没有引用怎么办? 不要急着大改。先看抓取日志,如果 AI 爬虫根本没来,检查 robots.txt 和网络配置;如果来了但没引用,回到内容页看是否缺少明确数字、地址、适用对象。引用是结果,不是动作。

更多关于生成式引擎优化的基础概念,可以看 GEO 指南;如果还没分清 SEO 和 GEO 的区别,从 SEO vs GEO 开始。