做单页seo时,抓取、索引和排名是三个先后不同、排查手段也不同的环节。抓取指搜索引擎爬虫是否来过并下载了页面;索引指页面是否被存入可检索的数据库;排名指页面能否在特定查询下出现在结果中。三者不能混为一谈:被抓取不等于被索引,被索引也不等于有排名。判断当前卡在哪一步,最直接的方法是按“爬虫是否访问→页面是否可被收录→查询是否出现”的顺序逐项检查。
抓取是入口环节。如果爬虫从未访问页面,后面的索引和排名都无从谈起。可以查看服务器访问日志,筛选搜索引擎爬虫的 User-Agent,观察目标 URL 是否出现、返回状态码是什么。
这一步的判断结果是明确的:日志里有没有目标 URL,比任何猜测都可靠。如果无法查看日志,也可以用搜索引擎提供的网址检查类工具发起一次实时抓取测试,观察返回的 HTML 是否与预期一致。
抓取成功后,搜索引擎还要决定是否收录。索引状态可以通过站点查询指令或站长工具中的“已编入索引/已收录”状态查看。常见的未收录原因包括:
noindex 指令,明确要求不收录。robots.txt 屏蔽了该路径,爬虫无法抓取,自然无法索引。需要区分“可能原因”和“已经定位的原因”。例如,发现未收录只是现象,不能直接断定是内容质量差;应先排除 noindex、robots.txt、状态码这些确定性因素,再考虑内容层面的判断。
三个环节的处理方式不同,用错方向会白费力气。
robots.txt 是否误屏蔽、服务器是否稳定返回 200。必要时通过站点地图或提交入口提示搜索引擎。noindex,确认 canonical 指向自身而非其他页面,确认正文在无 JavaScript 情况下也能获取核心内容。一个简化的假设例子:某单页在日志中有爬虫访问、状态码 200,但查询站点收录状态显示未收录,同时页面源码含 <meta name="robots" content="noindex">。此时问题定位在索引环节,处理方式是移除该指令并等待重新处理,而不是去改标题或加外链。反过来,如果页面已收录、查询品牌词能出现、但目标关键词无排名,则属于排名环节,应检查内容是否真正回应了该查询。
每次调整后,用同一套检查项复查,避免凭感觉判断:
复查的周期取决于站点抓取频率和页面重要程度,没有统一的固定时间。关键是保持检查项一致,才能判断变化来自调整还是正常波动。
下一步:打开目标单页的源码和服务器日志,先记录爬虫访问与状态码,再查收录状态。把结果填进上面三类问题中,只处理当前真正卡住的那一环。