在博客编辑器里发完一篇文章,过几天搜不到,很多人会直接说“没排名”。但抓取、索引、排名是三件不同的事:抓取是搜索引擎发现并读取页面,索引是把页面存入可供检索的库,排名是用户搜索某个词时页面出现在结果中的位置。搜不到不一定是排名差,也可能是页面还没被索引。判断起点应该是:先在搜索引擎用站点限定查页面,看它有没有进入索引。
假设你在博客编辑器发布了一篇题为《新手如何选择跑步鞋》的文章,网址是 example.com/run-shoes。发布三天后,搜索完整标题找不到。可以按下面顺序排查:
site:example.com/run-shoes。如果结果里有这条网址,说明页面已进入索引,问题更可能出在排名或关键词匹配上。site: 查不到,再查 site:example.com,看整站是否被索引。整站都查不到,优先怀疑抓取或索引阻断,而不是排名。<meta name="robots"> 是否含 noindex。含 noindex 时,页面可以被抓取,但会被排除在索引之外。robots.txt 是否屏蔽了文章所在路径。被屏蔽时,搜索引擎可能无法抓取,自然也无法索引。这个顺序的关键是:先用“是否在索引中”把问题分成两半。已索引却搜不到,才进入排名讨论;未索引,就先解决抓取和索引。
抓取关注搜索引擎是否能访问页面。常见阻断包括服务器返回 4xx 或 5xx、robots.txt 禁止抓取、页面需要登录、链接入口太少导致长期未被发现。判断方法是看服务器日志中是否有搜索引擎爬虫的访问记录,或用搜索平台的抓取测试工具请求该网址。
索引关注页面是否被存入检索库。即使抓取成功,noindex、规范网址指向别处、内容与已有页面高度重复,都可能让页面不被索引。判断方法就是前面的 site: 查询,以及搜索平台里的页面索引状态报告。
排名关注页面在某个查询下的位置。它建立在已索引的基础上,还受关键词相关性、内容质量、外部链接、用户地域和搜索意图等因素影响。同一个页面在不同查询下排名不同,甚至同一查询在不同时间、不同设备上也会变化,所以不要用一次搜索就下结论。
noindex、或让旧网址返回 404。这类情况常是索引状态变化,而非单纯排名下降。常见错误是把这三种现象都归为“SEO 没做好”,然后盲目改标题、堆关键词。更有效的做法是先确定页面卡在哪一步,再针对那一步处理。
每次发布后按下面清单记录,能减少误判:
noindex,并确认规范网址指向自身。robots.txt 没有屏蔽该路径。site:具体网址 查询是否已索引。判断结果:第 1 至 3 步有问题,先解决抓取与索引条件;第 4 步查不到,继续等待并增加内链入口,或通过搜索平台提交网址;第 4 步能查到而第 5 步表现差,才去优化标题、正文结构和关键词覆盖。适用条件是页面内容本身可公开访问;如果页面本来就设置了登录可见或 noindex,那它不应出现在搜索结果中,这不是故障。
下一步:挑一篇你最近发布但搜不到的文章,先做 site:具体网址 查询,把结果记下来,再决定是处理索引还是处理排名。