答案不是把旧报表整包归档,而是把资料拆成“可迁移的原始事实”和“绑定渠道的加工结果”两层。渠道规则一变,前者继续可用,后者只留作历史对照。判断标准很简单:换一个渠道后,这份资料还能否独立解释清楚它是什么、从哪来、代表哪段时间。
小范围测试时,一套资料结构往往表现稳定:字段统一、命名一致、导出顺利。可账号或渠道一多,同样的结构开始出现例外——同一个指标在不同后台口径不同,同一批素材在不同位置的有效期不同,同一条记录在汇总时对不上。这不是执行变差,而是样本阶段的隐含前提在规模化后不再成立。
常见的情形是:测试期只有一两个渠道,字段含义靠人记住即可;规模扩大后,记录由多人、多批次写入,原先没写进字段的上下文就丢失了。此时资料看似完整,实际已经不可迁移。
解释一:资料结构没有把“来源”和“口径”写进记录本身。如果一条记录只存数值,不存它来自哪个渠道、按什么定义统计、覆盖哪段时间,那么渠道规则一变,这条记录就失去解释力。样本阶段靠记忆补上的信息,规模化后无法补。
解释二:渠道口径本身就不可通约,强行统一会制造假一致。不同渠道对同一动作的定义可能不同,比如“有效”可能指到达、可能指停留、可能指后续动作。把它们合并成一个字段,表面整齐,实际掩盖了差异。这种情况下,问题不在结构,而在把不可比的东西当成可比。
两种解释会导向不同动作:前者要补字段,后者要保留口径标签而不是合并。
可以做一个简单的核对:随机抽取若干条记录,只看记录本身,不看任何外部说明,问三个问题——它来自哪个渠道、按什么定义产生、覆盖哪段时间。如果多数记录答不上来,偏向解释一;如果答得上来但不同渠道的答案互相冲突且无法换算,偏向解释二。
另一个证据是回溯测试:取一段渠道规则变化前的资料,假设明天该渠道规则改变,看这些资料还能否支撑一次独立判断。能支撑,说明迁移层完整;不能支撑,说明关键信息仍绑在渠道侧。
假设某团队把各渠道的“内容触达”统一记为一个字段,测试期只有两个渠道,数值接近,看起来没问题。规模扩大到多个渠道后,同一字段在不同渠道分别代表展示、点击和到达。此时若渠道规则调整,这个字段既不能横向比较,也不能纵向追溯。改为保留原始事件名加渠道标签,再另建一个明确说明换算假设的汇总层,迁移能力就回来了。这里的关键动作是:先分离原始层与汇总层,再决定汇总层是否重建。这个动作直接影响下一步——如果原始层完整,汇总层可以随规则变化重算;如果原始层缺失,就只能重新采集。
需要强调的是,搜索、平台推荐和广告的指标含义不同,不能混用同一套口径去判断效果。保留渠道标签正是为了避免这种混用。
规则变化后,先做一次迁移检查:把原始层和汇总层分开评估。原始层通常可继续保留;汇总层要判断是否仍成立,不成立就标记为历史版本,而不是直接删除或强行沿用。
取舍在于:保留全部历史加工结果会占用维护成本,全部丢弃又失去对照。较稳妥的做法是保留原始层全量、汇总层只留关键节点,并写明每个节点对应的口径版本。这样下一步无论重建汇总还是切换渠道,都有可核对的依据。
最后提醒一点:某个渠道的请求量、抓取量或某项统计归零,不能单独证明资料处理正确,它也可能来自渠道侧调整、采集延迟或口径变更。把现象和原因分开记录,才不会把渠道波动误当成自身策略的结论。