大部分企业的官网内容不是太少,而是太旧。一个运营三年、累计发过 80 到 120 篇文章的站点,真正还在被 AI 引用的通常只有 15 到 25 篇,其余近百篇既拿不到排名,又占着页面权重和抓取预算。
这些内容不会安静地放着。它们会以三种方式持续扣分:一是同一话题多篇内容互相竞争,AI 在挑选引用来源时无法确定以哪一篇为准,最后干脆都不引用;二是过期的价格、过期的政策、过期的产品名被 AI 原样摘走,直接输出给潜在客户;三是站点整体内容质量评分被拉低,连带影响还在生效的那二十来篇。
所以存量治理不是有空再整理,而是做 GEO 之前必须清场的一步。判断标准只有一条:这篇文章能不能被 AI 完整摘出一段可用的答案。能,就更新;不能,就合并或下线。
处置动作只有三个,但要按内容状态来分。下表是八藏科技在实际项目中使用的分诊口径。
| 内容状态 | 判断依据 | 处置动作 | 预期工作量 |
|---|---|---|---|
| 主题有效、数据过期 | 话题仍在搜索需求内,但价格、数量、年份、产品名过时 | 更新:改数据、补新段落、更新发布时间 | 1—2 小时/篇 |
| 主题有效、结构太散 | 有内容但缺结论段、缺小标题、没有可被摘取的完整句 | 重写:保留素材,按 AI 摘取结构重组 | 2—4 小时/篇 |
| 同话题两篇以上并存 | 关键词高度重叠,标题意思相近,互相抢同一批问句 | 合并:以权重高的一篇为主,其余 301 转过来 | 3—5 小时/组 |
| 主题已失效 | 产品已下架、政策已废止、话题无人再问 | 下架:410 或 301 到最接近的有效页 | 0.5 小时/篇 |
| 纯资讯通稿、无信息增量 | 公告、活动、获奖类,无长期搜索需求 | 保留但移出 sitemap,不参与 AI 语料竞争 | 0.5 小时/篇 |
关键在于不要用全部重写这一种动作解决问题。全量重写既做不完,也会把本来还有排名的页面推倒重建,反而丢掉已有信号。分诊之后,真正需要大动的内容通常只占三成。
不是所有旧文都值得投入。筛选顺序是先看需求、再看承接、再看已有信号、最后看改造成本,前两项不合格的直接进入合并或下架流程。
去 AI 引擎里直接把这篇的主题当问题问一遍。如果 AI 给的答案完全不涉及你的主题,说明这个话题在生成式搜索里没有需求入口,不值得救。如果 AI 答了但引用的是别人,说明需求存在、你只是没被选中,这类最值得优先更新。
打开页面看三件事:有没有一句话直接回答标题提出的问题;有没有至少两级小标题;关键事实是不是独立成句。三项都没有的页面,改造成本接近于重写。
查一下这个页面有没有外链、有没有被收录、还有没有自然点击。有外链的老文优先更新,因为外部权威信号可以直接复用;零外链、零收录的页面,更新收益有限,可以考虑并入同话题的主篇。
超过 6 小时才能救活一篇,且该话题已有其他有效页面覆盖时,直接合并更划算。这一条是防止团队陷入单篇精修、整体停滞的陷阱。
很多团队的更新是把年份改一改,改完之后 AI 依然不引用。因为 AI 不引用的原因往往不是数据旧,而是结构无法摘取。建议的更新顺序如下。
这五步按顺序做,是因为前三步决定能不能被引用,后两步只决定引用得准不准。顺序颠倒会出现一种情况:数据都改对了,AI 还是一个字都不引。
合并是存量治理里风险最高的动作,做错会直接丢排名。核心原则只有一条:合并后必须有一个明确的、能被外部链接指向的页面活下来。
| 合并环节 | 错误做法 | 正确做法 |
|---|---|---|
| 选主篇 | 选标题更好看的那篇 | 选有外链、有收录、有历史点击的那篇 |
| 内容处理 | 两篇内容直接首尾拼接 | 按问句重排,去重后补一段跨篇总结 |
| 旧地址处置 | 停用或直接删除 | 301 永久跳转到主篇,至少保留 6 个月 |
| 内链更新 | 不管,留给搜索引擎自己发现 | 站内指向旧篇的链接手动改到主篇 |
| 标题处理 | 两个标题都留下 | 主篇标题覆盖两个话题核心词,副篇只做重定向 |
判断合并效果的观察窗口是 4 到 8 周。合并后两周内排名波动属正常;四周后如果主篇曝光量高于合并前两篇之和,说明合并成功;如果低于合并前两篇之和的一半,就要考虑把内容拆回去。
下架是最容易被忽略的动作,但有些内容留着就是负分。以下四种情况建议直接处置。
| 情况 | 典型表现 | 处置方式 |
|---|---|---|
| 产品已下线 | 页面上还在介绍已经停售的产品 | 301 到同品类在售产品页 |
| 政策已废止 | 引用的补贴、资质、标准已失效 | 删除,或改写为历史沿革说明 |
| 话题彻底无需求 | 在 AI 与搜索引擎里都无人再提 | 410 明确告知已移除 |
| 内容与主题无关 | 早年随手发的行业杂谈 | 410,或并入相近话题页 |
注意不要用设置 noindex 但保留页面这种半吊子做法。页面还在,AI 抓取依然会读到里面的过期信息;只是不收录,等于既没解决问题,也浪费维护成本。
存量治理最怕的是一次性全站开工,做到一半失去耐心,结果旧内容改了一半、新内容也停滞了。建议把治理和增量分开排期。
这套节奏下,一个 100 篇存量的站点大约需要 6 周完成治理,其中真正被重写的通常不到 20 篇。
存量治理的效果不会像新发文章那样立刻可见,需要用一组对照指标来观察。建议治理前记录一次基线,治理后第 4 周与第 8 周各测一次。
| 观察指标 | 测量方式 | 合理的改善幅度 |
|---|---|---|
| 被引用页面数 | 用核心问句在豆包、DeepSeek、Kimi、元宝逐一提问,记录引用来源 | 8 周内从 20 篇级升到 30 篇级属正常 |
| 单页摘取完整度 | 看 AI 输出的答案是否成句、是否带具体数据 | 从「提到」升级为「成段引用」 |
| 过期信息出现次数 | 搜品牌相关问句,看是否还输出旧价格、旧产品名 | 应降至 0 |
| 同话题竞争页数 | 站内自查,同一问句是否还有两篇以上页面在争 | 应降至 1 |
| 站点整体抓取量 | 在服务器日志里数 AI 爬虫的抓取条数 | 治理后 4—8 周内应有提升 |
其中过期信息出现次数是最直接的验证项,也是客户最容易感知的一项。它从有到无,通常发生在治理后 2 到 4 周。
第一个误区是更新等于改日期。只改发布时间不改内容结构,AI 不会因此改变引用决策,反而可能被判定为未实质更新,效果为零。
第二个误区是合并就是把两篇拼起来。直接拼接会产生重复段落,AI 在摘取时反而更难确定该取哪一段。合并必须按问句重排并去重。
第三个误区是下架等于删除。直接返回 404 会丢失历史信号,应该用 301 转到最接近的有效页,或用 410 明确告知已移除,两者都比 404 好。
Q:存量内容多久需要治理一次?
建议每 6 个月做一次轻量盘点,每 12 个月做一次完整治理。如果站点处于产品线调整期或行业政策变化期,盘点频率提高到每季度一次。
Q:预算有限的话,先治理还是先发新文?
先治理。存量里通常有三到五篇还有外部信号的老文,把它们救回来,见效速度快于从零写五篇新文,成本也只有一半左右。
Q:旧文更新后需要重新提交收录吗?
需要。更新完主动提交一次 URL,同时更新 sitemap 里该页的最后修改时间。AI 爬虫的调度周期不完全受提交影响,但搜索引擎的抓取优先级会明显提高。
八藏科技在存量内容治理上采用分诊优先、结构先行、先清场后增量的做法:先按五种内容状态分诊,再按四步指标筛选值得投入的篇目;更新时先调结构后改数据,合并时严格 301 保住外部信号,下架时用 410 或 301 而不是 404。基础服务 3,000 元起,定制价格请联系客服获取。
相关推荐

客户问「附近哪家好」,AI 为什么不推荐你?本地同城 GEO 怎么做
客户在 AI 里问「附近哪家做 XX 好」,答案里没有你,通常不是内容质量差,而是本地实体信息没被 AI 认出来。本文由八藏科技整理,讲清本地同城 GEO 与普通 GEO 的区别:普通 GEO 解决「AI 知不知道你是谁」,本地同城 GEO 解决「AI 知不知道你在哪儿、服务范围到哪、口碑怎么样」。文章给出四引擎(豆包 / DeepSeek / Kimi / 腾讯元宝)本地能力对照、六项本地字段(名称、地址、电话、服务范围、营业时间、类目)的统一清单、五类平台的覆盖优先级、同城问答的句式模板,以及「信息统一 2—4 周、地图收录 3—6 周、同城语料 6—10 周、稳定推荐 8—12 周」的四阶段节奏,并列出多门店连锁的正确做法与五个高频误区。八藏科技本地同城 GEO 基础服务 3,000 元起,定制价格请联系客服获取。

为什么 AI 总引用别人不引用你?GEO 内容写作的 6 条硬标准
AI 引用谁,和品牌大小没关系,只和「这一段能不能被整段摘走」有关系。八藏科技把被引用的内容拆回结构层,总结出 6 条硬标准:结论前置、小标题写成用户会问的那句话、可量化事实单独成句、用对照表、实体名唯一、带明确时间戳。本文逐条给出改写前后的对照,并说明执行顺序——先改小标题和结论,改动最小、见效最快;一篇 2000 字的文章按序整改约需 2 到 3 小时。同时回答三个高频疑问:改成 GEO 范式会不会伤 SEO、要不要为四个引擎各写一版、多久能看到品牌出现在 AI 回答里。

为什么 AI 搜不到我的品牌?AI 爬虫放行与 llms.txt 配置清单
AI 引擎搜不到你的品牌,多数不是内容问题,而是抓取层被挡住了。八藏科技给出抓取层排查顺序:robots.txt 是否放行 AI 爬虫、站点是否纯前端渲染、有没有 llms.txt。文中列出 10 种主要 AI 爬虫(OAI-SearchBot、GPTBot、Bytespider、DeepSeekBot、KimiBot、PerplexityBot 等)的用途与放行建议,说明检索类爬虫与训练类爬虫要分开配置;给出 robots.txt 按 UA 分组的写法示例与三个常见坑(全站通配禁止、CDN/WAF 边缘拦截绕过 robots.txt、改完不验证);解释 llms.txt 的现状与定位(社区约定而非强制标准,属加分项);用对照表比较 SSR、SSG、动态渲染、内容镜像四种解决纯前端渲染问题的方案;说明结构化数据对 AI 引用判断的间接作用,并给出 Organization/sameAs、Article、FAQPage 三档优先级;最后提供 5 步抓取层自查清单(检查项、合格标准、不合格后果、修复难度)。八藏科技基础服务 3,000 元起,定制价格请联系客服获取。