当 Justia 的创始人手写 I-9 类流程说明时,他可能没想到这段文字会成为生成式引擎优化(GEO)的一个观察样本。创始人写的说明很准,团队扩写后变空,而 robots 禁止 GPTBot 的讨论又给这场变化添了层不确定性。
创始人原稿为什么可引用
在 Justia 的公开页面上,有一段关于 I-9 类流程的说明。这段说明由创始人亲自撰写,语气直接,没有多余的修饰。它被生成式引擎多次引用,原因在于它恰好符合可核验的标准:来源公开、事实清楚、结构简洁。创始人在写这段说明时,没有考虑 SEO 的密度,也没有堆砌术语,只是把流程讲明白。
当用户向生成式引擎提问“I-9 类流程是什么”时,模型会优先选择那些能直接回答问题的文本。Justia 的这段说明因为句子短、信息点明确,被模型视为可靠的引用来源。创始人原稿的可引用性,不在于它写得多专业,而在于它没有把读者绕晕。
扩写后丢掉了什么
团队后来对这段说明进行了扩写。他们加入了更多背景、更多案例、更多内链,试图让页面在传统搜索中排名更高。扩写后的内容变长了,但生成式引擎的引用反而减少了。原因在于,扩写后的文本出现了大量冗余信息,模型在提取答案时需要过滤更多噪音。
创始人原稿里那些可以直接摘录的短句,被埋没在长篇大论中。扩写团队没有保留原稿的“硬句”,而是用更委婉、更复杂的表达替代了它们。结果就是,页面在传统搜索中的排名可能上升了,但在生成式引擎里的可见度下降了。
他们怎样设审核
Justia 并没有公开披露他们的内容审核流程。但从公开页面的变化可以推断,他们在创始人原稿和团队扩写之间找到了一种平衡。保留创始人原稿的核心句子,同时用扩写内容补充细节,但补充的部分不能影响核心句子的提取。
这种审核方式的关键在于:先确定哪些句子是“必须被引用的”,然后围绕这些句子组织内容。审核人员需要问自己:如果模型只抓取这一段,它能否直接回答用户的问题?如果不能,就需要调整。
流程化仍保留的硬句
即使在团队扩写后,Justia 的页面上仍然保留了一些创始人原稿里的硬句。这些硬句通常是定义性的、步骤性的,或者带有明确条件的。例如,“I-9 类流程的第一步是填写表格”这样的句子,不会被扩写成“在开始 I-9 类流程之前,您可能需要考虑填写表格”。
这些硬句是生成式引擎引用时的抓手。它们不需要上下文就能成立,而且能被直接摘录。流程化的内容生产很容易把这些硬句软化,但 Justia 的公开页面显示,他们有意保留了这些句子的硬度。
步骤
从 Justia 的这次变化中,可以提炼出几个步骤。首先,找出内容中那些可以直接回答问题的句子,把它们标记为“硬句”。其次,在扩写时,确保硬句的位置不被移动,表达不被改写。第三,检查页面是否被 robots 禁止 GPTBot 抓取,如果是,需要评估这是否影响了生成式引擎的引用。最后,定期用生成式引擎测试自己的内容,看哪些句子被引用,哪些被忽略。
这些步骤不需要复杂的工具,只需要对内容本身有清晰的认识。创始人亲写的优势在于,他们知道哪些句子是真正重要的。团队扩写时,需要把这种认识转化为审核规则。
还容易问的
为什么创始人写的说明更受生成式引擎欢迎?因为创始人往往更直接,没有那么多顾虑。他们写出来的句子更接近用户提问时的语言。团队扩写时,容易加入营销话术和行业黑话,这些都会降低可引用性。
robots 禁止 GPTBot 会影响生成式引擎的引用吗?如果页面禁止 GPTBot 抓取,生成式引擎可能无法直接读取内容,从而减少引用。但有些模型会通过其他渠道获取内容,所以影响不是绝对的。需要具体分析。
人力资源行业的其他内容也能这样优化吗?可以。只要内容本身有可核验的事实,并且用简洁的句子表达,就有可能被生成式引擎引用。关键不是行业,而是内容的质量和结构。
更多关于 GEO 的内容,可以查看 GEO 专题,以及 SEO 与 GEO 的区别。