内容媒体的编辑团队每天面对两个相反的压力:一边要追热点、发活动、挂价格;另一边这些内容没过几天就过期,变成 AI 引用时的隐患。生成式引擎抓取页面时,如果撞上过期的价格、已结束的活动或 404 链接,它不会替你兜底,而是直接跳过你的网站,去引用别家还活着的页面。要成为 AI 优先引用的信息源,内容媒体的 GEO 工作不能只靠多发稿,必须把「信息源治理」放到首位。

先画一张全貌

内容媒体的 GEO 不是 SEO 的替代品,而是把 SEO 里关于内容质量、技术健康度和权威信号的部分,重新按生成式引擎的抓取逻辑组织起来。生成式引擎优化(GEO)的核心目标,是让 AI 在生成回答时,把你的页面当作一段可引用的原文,而不是在训练数据里模糊地「见过」你的品牌。

对内容媒体来说,最常见的三类「信息源污染」是:过期价格、已结束的活动页、以及指向这些页面的 404 链接。它们共同造成一个结果:AI 抓取时发现你的页面不可信,于是降低对你的整体信任度。反过来,如果我们把这些页面清理干净,并把常青内容做成 AI 容易摘取的格式,媒体的引用率会明显改善。

下表列出了内容媒体 GEO 工作中几个关键层和它们对应的动作:

层级主要问题治理动作
内容层过期价格、活动页未下线、旧闻未标注删除或重定向,常青页补充「数据截止日期」
技术层404 链接、robots 封锁 GPTBot、缺少结构化数据修复死链,放行 GPTBot,添加 Article/FAQ 结构化数据
监测层不知道 AI 引用了哪个版本、哪些页面被跳过定期用日志和搜索控制台检查抓取与引用变化

这张全貌图的作用,是让编辑、技术和运营团队对 GEO 有同一个工作地图。不要把它当成一次性的项目,而是日常内容流程里的一部分。

内容层怎么建

内容媒体的常青内容不是「永远不变的文章」,而是「每次被引用时,信息仍然准确」的页面。很多媒体把活动页和价格页当常青页管理,这是最危险的误区。活动结束、价格调整后,页面如果不及时处理,AI 下次抓取就会拿到错误信息。

过期价格页的处理

价格页过期后,不要只把数字改掉,因为 AI 可能已经抓取了旧版本。最稳妥的做法是:

  • 立即删除或 301 重定向到新的价格页;
  • 如果必须保留历史记录,在页面顶部显眼标注「本价格已失效,更新日期见文末」;
  • 在页面内用结构化数据标记价格的有效期,让 AI 能识别时间范围。

活动页的下线与归档

活动页在活动结束后,应该统一重定向到活动专题页或日历页,而不是让其自然变成 404。如果活动页有用户评论或 UGC 内容,可以保留并标注「活动已结束,评论仅供回顾」,但不要在页面首屏继续展示报名按钮或优惠信息。

常青页的「数据截止日期」

媒体常青页(例如「2025 年最佳 VPN 推荐」)必须写明数据截止日期,例如「价格与功能更新于 2025 年 6 月 30 日」。这会让 AI 在引用时能判断信息的新鲜度,也会让读者知道什么时候需要回来查看更新。没有标注日期的常青页,AI 默认视为「可能过时」,从而降低引用优先级。

技术层不能漏

技术层是内容媒体最容易忽略的部分。很多媒体网站的 robots.txt 还停留在只允许百度或 Google 爬虫的阶段,没有放行 GPTBot 或其他生成式引擎的爬虫。这直接导致 AI 无法抓取你的正文,更谈不上引用。

放行 GPTBot 与生成式爬虫

检查 robots.txt 里是否有类似下面的规则:

  • User-agent: GPTBot 后面是 Disallow: /,表示完全禁止;
  • 如果网站只允许 Googlebot,那么 ChatGPT 的爬虫就进不来。

改成允许 GPTBot 抓取公开内容,但保留对管理后台、用户隐私页面的封锁。这一步不需要技术大改,几分钟就能完成,但很多媒体至今没做。

404 链接的清理

内容媒体网站经过多年运营,会产生大量死链。这些 404 链接不仅影响用户体验,也会让 AI 在抓取时频繁碰壁,降低对网站的整体信任。建议每月用工具(如 Screaming Frog 或网站后台的爬虫报告)扫描一次全站,批量修复或重定向。

结构化数据:让 AI 看懂你的媒体页面

给文章页面添加 Article 结构化数据,给问答类内容添加 FAQPage 结构化数据。这样 AI 在抓取时能直接识别标题、作者、发布日期、修改日期和正文结构,不必靠猜测。对于价格或活动页面,可以考虑使用 EventOffer 类型,标记有效期。

监测层怎么记

GEO 的效果不能靠感觉,必须记录 AI 是否开始引用你的页面。监测分成三个层面:抓取日志、引用变化、用户行为。

抓取日志

定期查看服务器日志,确认 GPTBot 或其他生成式爬虫是否访问了你的网站,以及它们抓取的主要是哪些页面。如果日志里看不到 GPTBot 的请求,说明 robots 或防火墙仍在拦截。如果 GPTBot 只抓首页不抓文章页,需要检查内链结构是否合理。

引用变化

在 ChatGPT 或 Perplexity 里,用与你的内容相关的问句测试,观察 AI 的回答是否提到你的媒体名或直接引用你的原文。每隔两周测试一次,记录结果。如果发现 AI 引用了过期价格,说明你的治理动作还没生效,要回头检查页面是否真的下线或重定向了。

用户行为

GEO 的最终目标是带来真实用户。观察从 AI 回答里跳转到你网站的访问量变化,以及这些用户在站内的停留时间和转化行为。如果 AI 引用增多但跳出率很高,可能说明被引用的页面没有满足用户预期,需要优化内容。

90 天路线

内容媒体的 GEO 整改可以分三个阶段,90 天内完成基础建设。每个阶段都有明确的可交付成果。

第 1–30 天:清理污染源

  1. 用爬虫扫描全站,导出所有 404 链接和过期价格页;
  2. 批量处理:删除、重定向或标注失效日期;
  3. 修改 robots.txt,放行 GPTBot;
  4. 给首页和重点频道页添加 Article/Organization 结构化数据。

第 31–60 天:常青页改造

  1. 选出 20 篇流量最高、最可能被 AI 引用的常青文章;
  2. 给每篇补充「数据截止日期」和「修改日期」;
  3. 将长段落改写成短段落,每段一个核心信息,方便 AI 摘取;
  4. 添加 FAQ 区块,用问答形式总结文章要点。

第 61–90 天:监测与迭代

  1. 建立每两周一次的 AI 引用测试记录表;
  2. 对比抓取日志,确认 GPTBot 稳定抓取;
  3. 根据测试结果,继续清理新产生的过期页面;
  4. 把 GEO 检查项加入日常编辑发布流程。

资源与内链

内容媒体的 GEO 不是孤立的项目,它依赖与 SEO 的配合。如果你还没看过本站的 GEO 基础指南,建议先读 GEO 是什么,了解生成式引擎优化的完整框架。如果对 SEO 与 GEO 的区别有疑问,可以看 SEO 与 GEO 的区别,避免把两者混为一谈。

外部资源方面,维基百科上的 Generative engine optimizationSearch engine optimization 提供了基础的术语解释和背景,适合团队内部快速对齐概念。但真正的执行细节,还是要回到你自己的网站日志和 AI 测试结果上。

把这份总指南收藏起来,每次内容更新前翻一翻,团队就不会再陷入「发了文章但 AI 不引用」的循环里。治理信息源,比写更多的文章更重要。