结论先说:新人诊断靠“现象清单”,资深人员诊断靠“因果链”。对照证据时,不要比谁说得对,而要比谁的判断能被下一步动作验证。样本只有一个页面时,两种方式往往结论相同;一旦放大到几十上百个页面,新人的清单就会失效,因为同一现象可能对应完全不同的原因。
新人常用的是“看到什么改什么”:标题重复就改标题,收录少就加内链,加载慢就压图片。这套方式在样本单一、问题集中、改动可逆的条件下成立。例如只练一个页面,标题、描述、正文结构都能逐一核对,改完再观察,反馈很清楚。
资深人员常用的是“先假设再证伪”:先提出一个可能的原因,再找能推翻它的证据。这套方式在页面数量多、变量交叉、改动成本高的条件下更稳。比如同一批模板页里,有的收录有的不收录,就不能按页面逐个改,而要先判断是模板结构问题、抓取预算分配问题,还是内容本身重复。
判断用哪种方式,看一个信号:如果同一现象在样本里只出现一次,用清单式诊断更快;如果同一现象在样本里反复出现、但原因不一致,就必须换成因果链式诊断。
两类人最容易吵起来的地方,是拿同一个数字当不同用途。对照时先问:这条证据能区分两个假设吗?
能区分的证据通常带对照:改前改后同一页面的对比、同模板不同页面的对比、同页面不同时间段的对比。没有对照,就只是现象,不是证据。
假设有一批详情页,其中约一半没有被收录。新人会直接给未收录页面加内链,然后等结果。资深人员会先取两组页面:一组已收录、一组未收录,比较它们的模板结构、正文长度、外链来源和抓取日志。如果两组在这些维度上没有明显差异,那么“内链不足”这个假设就被削弱,下一步应转向检查抓取频次或服务器响应。
这个例子里,动作是“取两组页面做对照”,结果是“假设被削弱或加强”,下一步据此决定改内链还是查抓取。注意这是假设情景,用来演示对照方法,不是真实项目结论。
个别样本成立的经验,放大后经常失效,原因通常有三个:
写清边界的方法是:在结论后面加一句适用条件。例如“在模板一致、正文长度相近的页面组里,加内链有助于收录”,而不是“加内链能提升收录”。前者能被验证,后者只能被争论。
无论用哪种方式,都建议把判断写成可验证的形式:假设是什么、用什么证据支持、什么情况下这个假设不成立。新人可以先把清单式结论转成一句假设,资深人员可以把因果链拆成一条可观察的指标。两边对照时,比的不是经验多少,而是谁的判断能被下一步动作检验。做完这一步,再决定是继续改内容、改结构,还是先补数据。