抓取、索引和排名是三个先后不同、失败原因也不同的环节。抓取是搜索引擎发现并读取URL;索引是读取后判断内容是否值得存入可检索库;排名是用户搜索时,从已索引内容里挑出结果并排序。一个页面可能被抓取但未索引,也可能已索引但排名很差。区分它们,才能知道该修技术、内容还是竞争策略。
不要凭感觉说“没排名”。把结果拆成可观察的状态:
site:查询只能作为粗略参考,更可靠的是在搜索引擎的站长工具里查看URL检查结果,看它是否被收录、是否有“已发现但未索引”或“已抓取但未索引”等状态。适用条件:只有当页面返回200、robots允许、有内链或站点地图时,才能先怀疑索引;若日志里根本没有爬虫访问,应先解决发现与抓取,而不是改标题。
抓取问题多由技术配置造成,责任在开发或运维;索引问题常由内容质量、重复页面、规范标签或渲染方式造成,责任在SEO与内容团队;排名问题涉及关键词意图、页面体验和外部链接,责任在SEO与市场团队。把三者混在一起,会出现“页面没收录却拼命加外链”或“排名差却反复提交站点地图”的无效动作。
一个可执行的检查顺序:
注意:同一现象可能有多个解释。例如“搜不到”可能是未索引,也可能是已索引但排名太靠后,不能只凭一个查询下结论。
抓取通过的标准是:服务器日志出现该URL的正常访问,且状态码为200。索引通过的标准是:站长工具显示该URL已被索引,或搜索结果中能直接找到该页面。排名通过的标准是:在目标词下,页面出现在可接受的位置区间,并且展示信息与页面内容一致。
假设你有一个新页面,提交站点地图三天后仍搜不到。先查日志:如果爬虫从未访问,问题在发现层,应检查内链和站点地图;如果爬虫访问了但返回500,问题在服务器;如果返回200但站长工具显示“已抓取,尚未索引”,问题在内容质量或重复度;如果已索引但搜不到,问题在排名竞争。每一步只修对应环节。
挑一个你最关心的页面,按“日志→索引状态→目标词搜索”的顺序各查一次,把结果写成三行:是否被抓取、是否被索引、目标词下实际位置。哪一行是“否”或“很差”,就先处理哪一行,不要同时改所有东西。