先给结论:不要再用试做时那份“标杆样本”去对照全部批量件,而要把抽查拆成三层——先确认批量件与试做件是否落在同一交付口径内,再按可区分的原因分组抽样,最后用一次小规模返工验证问题出在标准、执行还是验收。抽查的目标不是证明对方变差了,而是找出变差发生在哪一层,从而决定是补标准、换执行人还是终止合作。
试做阶段通常有额外沟通、专人跟进和反复修改,批量阶段往往按模板和排期走。这两者不在同一条件下,直接对比会误判。你要做的第一个动作,是把试做件当时确认的交付说明、修改记录和验收口径翻出来,逐条标出哪些是“试做专属”,哪些是批量也承诺的。
如果试做时口头确认的细节没有写进批量交付说明,那么批量件变差可能只是标准没同步,而不是能力下降。这种情况下先补一份书面口径,再抽一批重验,结果才有意义。反之,如果口径完全一致而批量件仍明显粗糙,问题就更可能出在执行或排期上。
随机抽样只能告诉你“整体大概如何”,不能告诉你“为什么变差”。更有效的做法是先列出可能导致变差的几个变量,再按变量分组各抽少量样本。常见的分组维度包括:
假设某批交付共四十件,其中十件由同一名执行人完成。如果这十件的问题率明显高于其余三十件,那么原因更可能指向人员而非标准;如果所有分组的问题率都接近,才更可能是标准或流程整体失效。这个比较方法本身不依赖具体数字,你只需保证每组样本量足够看出差异。
“变差”是个模糊感受,抽查时要转成可判断的项,否则不同人复核会得出不同结论。建议至少覆盖以下几类,每类都对照试做件当时的水平:
每一项都标注“符合、部分符合、不符合”,并记录具体位置。这样得到的是可追溯的清单,而不是一句“质量下降了”。
抽查之后不要立刻下结论,先做一次受控的小规模返工。挑出问题最集中的几件,要求对方按书面口径重做,并观察返工结果。这一步能区分三种情况:
返工结果会直接决定下一步:改善则继续合作但增加抽检频率;不达标则考虑缩减批量、改为分批验收;反复回落则把验收责任前置,要求对方在交付前自检并留下记录。
试做表现好、批量变差,本质上是验收节奏没跟上规模。与其每次事后追查,不如把抽查固化成每批交付的固定环节:先核对口径是否一致,再按分组抽样,再用清单逐项判定,最后用返工验证。这样你手里始终有一份可对比的记录,合作是否继续、按什么条件继续,都有依据可循,而不是靠印象做判断。