试做样本通常由外包团队里最强的人做,批量交付则分散到普通执行者,所以“试做好、批量差”是外包中最常见的滑坡。抽查的正确做法不是加大抽检比例,而是把试做阶段的表现拆成可复现的标准,再用分层抽样验证批量件是否达到同一标准。抽查结果只用于判断“能不能继续放量”或“必须退回重做”,不用于给整批交付打分。
批量交付变差通常有三个可区分的原因,抽查前先想清楚要验证哪一个:
这三种原因对应三种不同动作:换人、补标准、调产能。抽查如果只统计“合格率”,无法区分它们,也就无法决定下一步。
拿你手上已经验收通过的那份试做件,逐项写出“当时为什么算合格”。判定项要具体到能一眼判对错,例如:
假设试做件有 10 个判定项,其中 6 项是硬性项(错了必须退回),4 项是弹性项(可批量修正)。这个划分决定了抽查时哪些错误触发整批复核,哪些只需记录。
随机抽 10% 在批量交付里往往不够,因为问题可能集中在某个执行者或某类页面上。更有效的抽法是:
抽查时只记录硬性项的通过与否,弹性项单独列清单。这样得到的不是分数,而是“哪一组、哪一类、哪一项在批量时失效”。
假设抽查 20 件,硬性项错误分布如下:执行者 A 的 5 件全部通过,执行者 B 的 5 件有 3 件标题重复,执行者 C 的 5 件有 4 件缺失约定问题,剩余 5 件来自不同人、错误分散。这个结果说明标准本身没写清,而不是某个人不行。
对应的动作是:暂停向 B、C 继续派量,先把判定项写成书面清单并让所有执行者按清单自查一遍,再抽同一批人的新件复核。如果复核后错误集中在同一项,说明标准仍不够具体;如果错误分散到不同项,说明需要缩小单人交付范围或降低单批数量。抽查的价值在于让下一步动作有依据,而不是证明谁合格。
批量交付变差时,很多团队会先加大抽检比例。但抽检只能发现问题,不能阻止问题进入已交付部分。更实际的做法是要求外包方在每批交付前提供一份自查记录,列出本批硬性项的通过情况。你抽查时对照自查记录,如果自查说通过而实际不通过,问题就从“执行质量”变成“自查机制失效”,处理方式也随之改变:需要重新约定自查由谁做、做到什么程度,而不是继续加抽。
抽查频率不必固定。在标准刚补写、执行者刚更换、页面类型刚扩展这三个时点各做一次分层抽查,比每月固定抽一次更能暴露真实变化。每次抽查后只回答一个问题:当前这批能不能继续放量。能,就按现有标准继续;不能,就退回上一批已交付件做同类抽查,确认问题范围后再决定是返工还是重做。