返回文章
NO.
030
DATE
READ
~10 min
KIND
教程
STATUS
原文

TAGS: SEO

SEO 基础:从抓取、索引到转化的诊断框架

用一条从抓取、索引、相关性、搜索结果点击到站内转化的链路解释 SEO,并给出常见问题、证据来源、排查顺序和 GEO 衔接方法。

SEO 常被压缩成「选关键词、发文章、做外链、等排名」。这种描述列出了动作,却没有说明动作为什么有效,也解释不了一个常见场景:页面已经收录、甚至有展示,为什么仍然没有点击和询盘?

更稳妥的理解是:SEO 是一条从页面被发现,到信息被理解,再到合适的人完成下一步行动的链路。 排名只是链路中间的一种可见结果,不是全部目标。

本文把这条链路拆成五层,随后用它诊断常见问题。它不是排名秘籍,也不承诺某项修改必然带来结果;搜索引擎是否抓取、索引和展示页面,本来就没有保证。

SEO 到底在优化什么

Google 的 SEO 入门指南给出的定义很克制:帮助搜索引擎理解内容,也帮助用户通过搜索判断是否值得访问网站。

这个定义里有两个对象:搜索引擎和用户。只照顾其中一个,SEO 都会变形。

  • 只照顾搜索引擎:页面堆关键词、批量生成近义内容,却没有人愿意读。
  • 只照顾用户:内容可能很好,但入口被 robots、登录墙、错误 canonical 或孤立页面挡住,搜索引擎无法稳定发现。
  • 两边都照顾,却不连接业务:有点击,但访问者不知道下一步该看产品、下载资料还是提交询盘。

因此,一个可执行的 SEO 模型至少包含五层:

层级核心问题主要证据常见动作
发现与抓取搜索引擎知道 URL 存在,并能取得内容吗?URL 检查、抓取日志、内部链接、sitemap、HTTP 状态修复阻断、补可抓取链接、清理错误 URL
索引与规范化搜索引擎愿意保存哪个版本?索引状态、Google 选择的 canonical、robots meta去重、统一 canonical、处理 noindex 与重定向
相关性与质量页面真的回答了查询背后的任务吗?查询—页面对应、页面正文、竞争结果类型调整页面类型、补关键证据、合并薄内容
搜索结果点击用户看到结果后愿意点吗?展示、点击、CTR、设备、国家、搜索外观改进标题与摘要、对齐意图、增强可信信号
站内行动点击进站后能完成下一步吗?GA4 事件、表单、下载、询盘质量、页面路径修复承接、降低摩擦、补信任信息与转化入口

这五层有先后依赖。页面抓不到时,讨论标题 CTR 没意义;流量意图错了时,单纯换 CTA 也不会把错误受众变成客户。

先把几个容易混淆的概念分开

抓取不等于索引

抓取是搜索引擎取得页面,索引是搜索引擎分析页面后决定是否把它保存在索引中。一个 URL 可以被抓取,却因为重复、质量不足、noindex 或 canonical 选择而没有进入索引。

sitemap 也不是收录申请书。它能帮助搜索引擎发现优先 URL,并提供 canonical 的弱信号,但不能替代内部链接、内容质量和正确的状态码。

索引不等于排名

索引只说明页面具备参与检索的可能。是否展示,还取决于查询相关性、内容质量、语言、地区、设备以及大量其他信号。

如果 Search Console 显示页面已索引,但目标查询没有展示,先检查页面是否真的满足该查询,而不是反复提交索引。

排名不等于点击

Search Console 的「平均位置」是多次展示位置的平均值,而且不同搜索结果形态会影响计算。它不能脱离查询、页面、国家、设备和日期单独解释。

同样是平均位置 8:一个品牌词可能获得很高 CTR,一个宽泛信息词可能很低。诊断时应先看查询和页面组合,再看汇总平均值。

点击不等于有效转化

自然点击只证明用户从搜索结果进入网站。用户是否属于目标市场、是否看到了正确产品、表单是否可用、销售是否及时跟进,是另一条链路。

对于 B2B 网站,「表单提交」也不是终点。至少还要区分垃圾、求职、供应商推销和真实采购需求;否则 SEO 报告里的询盘数与业务价值之间仍然断着。

七类常见 SEO 问题怎么排查

1. 页面迟迟不收录

不要先问「怎么催 Google」,先问页面在哪一层掉了。

依次检查:

  1. URL 是否返回 200,是否需要登录,页面主要内容是否在渲染后可见。
  2. robots.txt 是否阻止抓取,robots meta 或响应头是否包含 noindex。
  3. 页面是否有来自已知页面的标准 <a href> 内链,还是只能靠站内搜索或 JavaScript 点击事件到达。
  4. self-canonical 是否指向自己;若不指向,目标 URL 是否才是真正希望收录的版本。
  5. 内容是否与其他页面高度重复,是否只是标签页、筛选页或几句话的薄页面。
  6. sitemap 是否只提交希望公开、返回 200、可索引的规范 URL。

验收不应写成「重新提交后已完成」,而应写成「URL 检查显示可抓取、无 noindex、canonical 一致;后续观察 Google 选择的 canonical 和索引状态」。提交动作不是结果。

2. 有展示,但点击很少

CTR 等于点击除以展示,但这个比例必须放回上下文。

先在 Search Console 里按查询、页面、国家、设备和日期切分,再判断:

  • 展示来自品牌词还是非品牌词。
  • 页面是否匹配查询意图,例如产品页是否在回答教程问题。
  • 平均位置是否因为大量低位长尾展示被拉低。
  • 标题与摘要是否准确说明页面价值,还是只重复关键词。
  • 搜索结果是否被图片、视频、本地结果或生成式答案改变了点击路径。

标题优化的验收,不是「改得更吸引人」,而是记录修改日期,在可比查询与页面范围内观察 CTR、点击和位置是否出现方向一致的变化。同时要避免在位置明显变化时把 CTR 变化全部归因给标题。

3. 有点击,但没有询盘或关键行动

这通常不再是纯粹的排名问题,而是意图与承接问题。

可以把检查分成四段:

  • 流量:进入页面的查询是否包含采购、比较、规格、供应商等商业意图。
  • 页面:搜索结果承诺的内容,落地页是否立刻兑现。
  • 信任:是否提供规格、适用条件、交付能力、案例边界、联系方式与真实主体信息。
  • 摩擦:移动端表单能否提交,字段是否过多,按钮是否清楚,成功事件是否真的埋点。

如果只有 GSC,没有 GA4 事件和销售反馈,只能确认搜索侧发生了什么,不能把「无记录」直接写成「无转化」。

4. 流量上涨,但业务没有变化

先把流量按查询意图和落地页类型分组。增长可能集中在教程、事件或宽泛概念词,而真正承接产品需求的页面没有变化。

这时需要同时看三组指标:

观察层例子能回答什么
搜索需求非品牌商业词、问题词、国家增长来自哪类需求
页面承接产品页、方案页、文章页、参与事件哪些页面得到并留住访问
业务结果有效询盘、下载、报价、样品申请流量有没有进入业务链路

只展示总流量,无法区分增长是资产还是噪音。SEO 月报如何筛掉没有决策价值的指标里专门讨论了这一点。

5. 多个页面争同一批查询

「多个页面都提到同一个词」不自动等于关键词蚕食。真正的问题是:多个 URL 在满足相同意图、竞争相同查询,而且没有清楚的主次关系。

排查时把查询映射回页面:

  • 如果页面对应不同意图,例如产品页与教程页,可以保留,并用内链说明关系。
  • 如果内容高度重复,选择更完整的页面作为主版本,合并内容并重定向旧 URL。
  • 如果是筛选参数和重复分类造成,应从 canonical、内部链接和索引控制处理,而不是继续改文案。

6. 文章发得很多,主题权重仍然没有形成

持续发布本身不是质量信号。Google 对 people-first content 的建议明确提醒:不要为了搜索流量大规模生产很多主题,也不要仅仅因为想让网站看起来「更新鲜」而增加内容。

一个主题簇要成立,至少需要:

  • 明确服务同一类读者和问题空间。
  • 每篇解决不同子问题,而不是换词改写。
  • 用上下文清楚的内链连接基础概念、操作方法、案例和工具。
  • 能增加原始分析、可核证据、限制条件或更好的决策框架。
  • 定期修订已经过时的内容,而不是只加新 URL。

这篇文章、外链建设框架和SEO 与 GEO 的关系就是一组内容分工:一篇解释站内诊断,一篇解释站外引用与风险,一篇解释答案引擎可见性。它们互相补足,不重复争同一个问题。

7. 工具报了很多错误,不知道先改什么

爬虫工具会平等地列出问题,业务却不会平等地承受问题。

优先级可以按四个问题排序:

  1. 影响的是关键页面,还是无业务价值的边缘 URL?
  2. 问题阻断抓取、索引或用户行动,还是只是不够整齐?
  3. 影响范围是一页、一个模板,还是全站?
  4. 修复能否被验证,是否存在回滚路径?

通常,关键页面返回错误状态、错误 noindex、canonical 指错和全站模板问题,应排在少量缺失描述、低价值归档页标题重复之前。但实际顺序仍取决于站点目标和影响范围。

一套从指标回到动作的诊断顺序

面对「5 万展示、1000 点击、12 条询盘」这类题,直接给优化方案很容易跳步。更可靠的顺序如下。

第一步:确认定义和数据链

  • 5 万展示和 1000 点击来自哪个时间段、国家、设备和搜索类型?
  • 12 条询盘是表单提交,还是销售确认的有效询盘?
  • GSC、GA4、表单和 CRM 之间能否用页面、事件或来源连接?
  • 与上一可比周期相比,哪个指标发生了变化?

在这个示例里,CTR 是 2%,点击到询盘的表面比例是 1.2%。后者只有在 12 条询盘确实来自这 1000 次自然点击、口径一致时才成立,不能默认成立。

第二步:定位掉点层级

  • 展示不足:检查覆盖需求、索引和相关性。
  • 展示有、点击少:检查查询—页面—搜索摘要。
  • 点击有、行动少:检查意图、落地页、信任和摩擦。
  • 行动有、有效询盘少:检查受众、报价条件和销售反馈。

第三步:一次只改一组主要变量

选择影响最大的页面组,记录修改前基线、改动内容、预期影响和观察窗口。不要同一时间重写标题、换模板、迁移 URL、增加大量内链,最后再把全部变化归因给其中一个动作。

第四步:用结果决定下一轮

SEO 变化可能需要几周甚至更久。观察期结束后,把结论分成三类:

  • 已支持:指标按预期方向变化,且没有明显替代解释。
  • 未支持:没有观察到预期变化,停止扩展同类动作。
  • 暂不确定:样本太小、同期发生其他变化或数据链不完整,继续观察但不宣称成功。

SEO 与 GEO 是什么关系

GEO(Generative Engine Optimization)关注内容在生成式答案中的可见性、引用和转述。它改变了信息呈现方式,但没有取消 SEO 的基础链路。

Google 的现行官方口径很明确:AI Overviews、AI Mode 等生成式搜索功能仍建立在核心搜索索引和质量系统之上。页面要进入这些功能,首先仍需可抓取、可索引,并具备在搜索结果中展示摘要的资格;不需要专门的 AI 文件或神秘标记。

两者可以这样分工:

层面SEO 重点GEO 增加的要求
技术可抓取、可索引、规范 URL、良好体验同样的技术地基,没有独立捷径
内容匹配查询意图,帮助用户完成任务结论、实体、条件和证据更便于准确抽取
站点结构页面层级、上下文内链、主题覆盖让答案引擎能沿主题关系找到补充来源
站外信号发现、相关性、声誉和引荐流量独立来源的可核提及有助于交叉验证,但没有引用保证
衡量展示、点击、CTR、页面行动、业务结果还需观察答案中的引用、品牌提及及生成式搜索流量

因此,GEO 不应变成一条与 SEO 平行的新生产线。先修复抓取、索引、内容和转化链路,再把关键段落写得更可引用,并补足可靠来源。完整方法见《GEO 不是给 ChatGPT 做 SEO》;站外引用如何获取及控制风险,接着看外链建设框架。

最后用一张表确定动作

做 SEO 诊断时,可以要求每个问题都填完下面五列:

症状证据假设动作验收
用户看到什么变化数据从哪里来、口径是什么最可能的机制,不写成事实本轮具体改什么何时、用什么信号判断

如果「证据」为空,先补测量;如果「验收」为空,动作就无法复盘;如果一个动作对应十个假设,范围还没有收紧。

SEO 的深度不来自术语数量,而来自能否沿着链路定位问题、选择动作,并对结果保持克制。站点持续产出内容的价值,也不在于 URL 越来越多,而在于读者面对一个真实问题时,能沿着内链找到越来越完整、越来越可信的答案。

评论 →

CC BY-NC-SA 4.0

评论

评论由 GitHub Discussions 提供。登录 GitHub 后即可评论。 前往对应 Discussion