抓取、索引和排名是三个先后不同、判定方式也不同的环节。抓取是搜索引擎发现并读取页面;索引是把读取到的内容分析、归类并存入可供检索的库;排名是用户搜索某个词时,系统从已索引内容中挑选并排序。判断问题出在哪一步,关键看页面是否被抓取、是否进入索引、以及针对具体查询是否获得展示,而不是只看流量涨跌。
抓取解决“搜索引擎能不能拿到页面内容”。它关注的是页面能否被访问、是否被阻止、链接是否可发现。索引解决“内容能不能被当作候选答案”。它关注的是页面是否有可理解的主题、是否重复、是否被标记为不收录。排名解决“在某个查询下排第几”。它关注的是相关性、内容质量、页面体验和竞争程度。三者是递进关系:没有抓取就谈不上索引,没有索引就不会出现在自然搜索结果里,但被索引也不等于有排名。
robots.txt 是否误屏蔽;重要页面是否有内链指向。如果日志里完全没有访问记录,优先排查抓取;如果有抓取但站点查询找不到页面,优先排查索引;如果已被索引、但目标查询没有展示,才进入排名分析。注意,一个现象可能有多个解释,例如“没有流量”既可能是没索引,也可能是排名靠后,不能直接断定是某一个原因。
robots.txt 和页面级 robots 设置,确认没有误挡。适用条件是:你面对的是一个具体页面和一组具体查询。如果只是笼统地看整站流量,三个环节会混在一起,难以定位。
假设某产品页在日志中没有搜索引擎访问记录,说明问题更可能在抓取,应先解决可访问性和链接发现。假设日志有访问、站点查询也找不到该页,说明更可能在索引,应检查内容是否重复、是否被标记为不收录。假设页面已被索引,但目标查询没有展示,说明更可能在排名,应比较内容与查询意图是否匹配。这里的“假设”只用于说明判断路径,不代表真实站点数据。
下一步,选一个你关心的页面和一个具体查询,按“可访问—可发现—已索引—有展示”的顺序做一次记录。记录结果后,只针对卡住的那一环处理,不要同时改标题、改内容、改链接,否则无法判断哪项调整起了作用。