抓取、索引、排名是三个先后衔接但彼此独立的环节:抓取是搜索引擎发现并读取页面,索引是把可用的页面内容存入可供检索的库,排名是在用户查询时从已索引内容中挑选并排序。一个页面没流量,可能卡在任意一环,所以定位问题时不能只看排名,而要先确认它有没有被抓取、有没有被索引,最后才谈排名。
把三者拆开看,判断依据会清晰很多。
三者的顺序是固定的:没被抓取,就谈不上索引;没被索引,就谈不上排名。但反过来,被抓取不等于被索引,被索引也不等于有好排名。这正是很多新手把问题混在一起的原因。
当某个页面表现异常时,按下面的顺序逐层排查,每一步都有对应的判断结果。
site: 加上具体地址。如果抓取正常但未被索引,问题在索引层。这三步的价值在于:它把“没流量”这个模糊现象,拆成了可以分别验证的三个状态。任何一步没通过,后面的讨论都没有意义。
下面这些现象经常被误判,实际归属并不相同。
noindex 指令、是否被 robots 规则拦截、内容是否与其他页面高度重复。区分“可能原因”和“已确认原因”很重要。例如页面搜不到,可能是 noindex,也可能是抓取受限,还可能是内容质量判断,只有逐项验证后才能下结论,不能凭单一现象断言唯一原因。
假设你发布了一篇新文章,一周后搜索标题仍找不到。按顺序操作:
site: 加文章完整地址,若返回该页面,说明已索引,问题在排名层,应优化标题与内容匹配度。<meta name="robots" content="noindex">,有则移除后重新提交。noindex,查看服务器日志确认爬虫是否到访。未到访则属于抓取层,可通过内链或提交入口引导发现。适用条件是:页面可正常访问、无技术拦截。判断结果是:每一步的通过或失败,直接指向对应环节,而不是笼统地归因于“SEO 没做好”。
完成排查后,可以用三个信号验收:抓取层看日志中是否出现成功请求;索引层看站点查询是否能返回该 URL;排名层看目标查询下是否出现该页面及其大致位置。三者依次通过,才说明整条链路正常。
下一步建议:挑一个当前表现异常的页面,按上面的抓取、索引、排名顺序完整走一遍,记录每一步的检查结果,再决定优化动作,而不是同时改动多个因素。