生成式引擎优化(GEO)的核心,是让公开页面成为 AI 答案里可核验的引用源。但当页面本身过期、下线或被改写,AI 仍会抓着旧内容不放。Glassdoor 的一场活动页事故,就展示了招聘平台如何从引用链里拔掉一根刺。
错是怎么被发现的
2025 年 3 月,一位负责招聘内容运营的团队主管在例行抽查生成式回答时,发现同一个问题反复得到错误答案。用户问「Glassdoor 上最近有招聘会活动吗」,多个 AI 引擎都引用了 Glassdoor 活动页的旧内容。页面上的活动日期停在 2024 年 11 月,但 AI 的回答却把活动描述为「正在进行中」。内容团队立即在内部笔记里标注:第三方模型抓取的是缓存版本,而不是当前页面。
进一步核查发现,该活动页在 Glassdoor 官网已经下线,但 AI 引擎仍通过历史索引和外部转载链接引用它。招聘社区里有人截图提问,用户点击 AI 给出的链接后,跳转到 Glassdoor 的 404 页面。内容负责人意识到,这不是简单的内容过期,而是引用链断裂后,AI 仍在用旧材料回答新问题。
作战室先停什么
当天下午,内容、SEO 和产品支持团队拉了一个线上作战室。他们没有急着发更正声明,而是先停止了三件事:第一,停止在自有渠道继续分享旧活动页的链接;第二,停止向任何 AI 训练数据源提供旧页面的快照;第三,停止在内部文档里引用旧页面的指标。作战室里的第一张共享表格列出的不是「我们要做什么」,而是「哪些动作会继续扩大错误引用范围」。
团队发现旧页面虽然下线,但仍有多个外部招聘聚合网站保留了旧活动描述,并且这些页面没有加 noindex 标签。AI 引擎的爬虫通过聚合网站再次抓取到旧内容,形成了二次传播。作战室决定,先联系三家主要聚合网站,请求更新或删除旧活动信息。同时,技术团队检查 Glassdoor 的 robots.txt 和 sitemap 配置,确认旧活动页的 URL 已正确返回 404 状态码,而不是 200 页面但内容为空。
公开更正
更正的第一步是在 Glassdoor 官方帮助中心发布一条简短说明,标题为「关于近期活动页信息的澄清」。说明中写道:「我们注意到部分第三方平台和生成式引擎仍显示已结束的招聘活动信息。该活动已于 2024 年 11 月 30 日结束,任何与此不符的描述均为过期引用。」这条说明没有点名任何 AI 产品,但明确了日期边界。
第二条更正是在活动页原 URL 上放置一个 410 Gone 状态码,并配置了自定义错误页面。新页面包含一行文字:「该活动已结束,请访问 Glassdoor 活动中心查看最新安排。」这行文字同时出现在页面标题和 meta description 里,确保爬虫和生成式引擎能读到明确的状态信息。团队没有尝试用新活动页覆盖旧 URL,因为旧 URL 的语义已经与旧活动绑定。
第三条更正是在 Glassdoor 的招聘博客上发布了一篇活动回顾文章,标题为「2024 秋季招聘活动回顾:参与企业名单与成果」。文章开头用粗体标注:「该活动已结束,本文仅作存档参考。」这篇回顾文章成为新的可引用对象,替代了旧活动页在生成式引擎里的位置。
怎样减少再错
作战室在两周后复盘,确定了三条长期规则。第一,所有活动页在上线时就必须包含明确的 startDate 和 endDate 结构化数据。Glassdoor 技术团队在活动页模板里加入了 Schema.org 的 Event 标记,确保生成式引擎能直接读取时间边界。第二,活动页下线后,必须同时更新内部链接指向,将旧活动名称从网站导航和相关推荐中移除。第三,建立月度引用审计,用人工查询和工具监测结合,检查生成式引擎对过期页面的引用情况。
团队还发现一个关键细节:旧活动页的标题和摘要都很短,没有包含活动年份。AI 引擎在生成答案时,无法判断活动是否过期,只能默认当前年份。因此,所有新活动页的标题和摘要都强制加入年份和「已结束」「进行中」等状态词。例如,标题写成「2025 春季招聘会(已结束)」,而不是「春季招聘会」。
同类预防清单
从这次事故中,Glassdoor 内容团队总结出一份预防清单,供其他招聘和人力资源品牌参考:
- 活动页上线时,在标题和摘要中写明具体年份和状态词,避免模型猜测时间。
- 使用 Schema.org Event 标记,包含 startDate 和 endDate,并在活动结束后更新 eventStatus 为 EventScheduled 或 EventPostponed。
- 活动页下线后,返回 410 Gone 状态码,并放置自定义说明页,注明活动已结束。
- 检查外部聚合网站是否转载了旧活动信息,请求更新或删除,避免 AI 通过第三方链接继续引用旧内容。
- 每月用生成式引擎测试 5-10 个活动相关问句,记录引用来源,发现过期引用立即启动更正流程。
- 在帮助中心维护一个「活动状态说明」页面,作为所有活动问题的官方答案锚点。
这份清单没有复杂的技术操作,但每一条都能直接减少生成式引擎引用过期信息的概率。Glassdoor 团队将清单公开在内部 wiki 上,并允许其他品牌内容团队参考。
还容易问的
Q:Glassdoor 活动页过期被 AI 引用,是模型的问题还是网站的问题?
A:双方都有责任。网站没有及时更新状态信息,AI 引擎也没有验证时间边界。但网站可以通过结构化数据和状态码减少被错误引用的可能。
Q:活动页下线后,是不是应该保留旧 URL 并重定向到新活动页?
A:不建议。旧 URL 的语义已经与旧活动绑定,重定向会让 AI 误以为旧活动仍在继续。更好的做法是返回 410 状态码,并在原 URL 上放置活动结束说明。
Q:生成式引擎引用过期内容,对招聘平台有什么实际影响?
A:最直接的影响是用户信任。当用户点击 AI 给出的链接后看到 404 页面,会对平台信息的准确性产生怀疑。长期看,可能影响品牌在招聘问答中的引用权重。
Q:小团队没有技术资源,怎么防止活动页过期被引用?
A:最简单的方法是在活动页标题和摘要中写明年份和状态词,例如「2024 秋季招聘会(已结束)」。即使没有结构化数据,模型也能从文本中判断时间边界。
Q:Glassdoor 的更正说明发布后,AI 引用多久会更新?
A:没有固定时间。取决于 AI 引擎的抓取频率和索引更新机制。但通过 410 状态码和自定义错误页,可以加速旧页面从索引中移除。