可复用的检查清单不是把SEO常识列一遍,而是先定义“什么算查清、什么算修完”,再倒推需要哪些资料、谁来做、用什么结果验收。针对搜索引擎不收录,验收结果应至少包含:目标URL、抓取状态、索引状态、内容质量判断、限制来源和下一步动作,六项齐全才算闭环。
每次排查结束后,应留下一份可交接记录,而不是只留一句“已提交”。记录至少回答六个问题:哪个URL、哪个搜索引擎、抓取是否成功、是否被索引、不收录的可能原因是什么、下一步由谁在什么条件下复检。缺少“搜索引擎”这一项,结论就不可复用,因为不同搜索引擎对robots.txt、站点地图和索引状态的支持与反馈并不一致,必须分别核查。
如果页面属于新发布,先确认它是否被内部链接或站点地图引用;如果页面属于老页面突然消失,先对比它最近的改版、迁移或模板变更。两类问题的资料需求不同,不能共用一套判断。
资料不齐时,只能记录“待确认”,不能写成“已定位原因”。例如日志里没有抓取记录,可能是链接太深,也可能是robots.txt拦截,还可能是服务器对抓取返回异常,需要逐项排除。
清单要能执行,就要把每个检查项写成“动作+责任角色+验收标准”。下面是一个可直接套用的最小结构,其中角色按团队实际情况替换:
如果页面涉及HTTPS,只能把它当作基础配置项来核对,不能因为启用了HTTPS就推断安全无漏洞或必然获得更好排名。
假设某产品页上线两周后未被索引(以下为假设示例,不是真实项目结果)。按清单执行:先查robots.txt,若发现Disallow: /product/,这属于“已定位的限制来源”,处理方式是调整规则并确认返回内容;若robots.txt无限制,再查页面级meta robots是否为noindex;若两者都正常,继续查内链与站点地图,并对比日志中是否有抓取记录。只有把“限制来源”与“内容质量”分开记录,复检时才能判断是修复生效,还是问题本来就在别处。
这套清单的适用条件是:页面可公开访问、团队能拿到日志或搜索平台数据。若页面需要登录才能看到主体内容,或站点整体被限制抓取,应先解决访问与抓取前提,再谈单页收录。
每次复检只改两类内容:一是补充新出现的限制来源,二是删除已被证明无效的判断项。判断结果只写三种:已收录、仍未收录、无法判断。无法判断时必须写明缺哪份资料,而不是用“可能”“大概”收尾。这样下一任接手人不需要重新问一遍,直接按缺口补资料即可。
下一步,挑一个当前未被收录的URL,按上面的六项交付结果填一份记录;填不出的项目就是你要补的资料或要分派的任务。