核心做法是把人工判断项从评分字段中拆出来,改为由人填写结论并附证据,自动评分只保留可量化部分;如果系统必须给出分数,就让分数只做排序参考,不直接决定项目通过或淘汰。下面从“分数看起来正常、人工结论却相反”这一矛盾现象切入,说明两种解释以及如何区分。
常见情形是:某个项目在旺道优化软件里综合分靠前,但负责复核的人看完内容后认为不该推进。此时不要急着改阈值,先判断这是哪一类问题。
两种解释的处理方向完全不同:前者要补人工维度,后者要修数据与权重。
可以做一个假设性对照:把同一批项目分别按“总分排序”和“人工结论排序”,观察两者不一致的项目集中在哪些字段上。
注意:分数排序与人工排序不一致,本身不能单独证明评分有问题,也可能只是人工标准更严。要结合字段明细一起看,才能定位原因。
防止被自动评分替代的关键动作,是让人工判断有独立的记录位置,而不是塞进备注里。可以这样设置:
做完这一步后,复核人看到的是“人工状态 + 参考分”,而不是“总分决定一切”。下一步就能按人工状态筛选,分数只用来排优先级。
有些流程无法取消评分,这时可以做两层处理:
这样即使分数存在,也不会替代人的判断。需要核对的是:当前工具是否支持自定义字段和状态,具体功能以实际版本为准,不同版本可能不同。
这套做法适合人工判断项明确、且能事先列出的场景。如果判断标准本身还在变化,先固定标准再拆字段,否则人工状态会频繁返工。另外,人工判断项不宜过多,控制在能逐条复核的范围内,否则复核成本会抵消自动化的价值。
判断是否做到位,可以看一个信号:当自动分与人工结论冲突时,流程是否允许人工结论直接生效。如果仍然要回头改分数才能推进,说明人工判断还没有真正独立。