不要试图把口碑“归因”到某个具体渠道,而应把来源记录拆成两层:一层记录可归因的首次接触,另一层单独记录口碑提及。两者并存时,只合并成一条来源会丢失信息,正确做法是保留双字段并规定谁写入、谁覆盖、何时冻结。下面以一个常见的线索表为例,说明怎么把这个原则落到可执行的处理方案上。
假设你手里有一张线索表,字段包括来源渠道、首次访问时间、转化动作、备注。现在出现一条记录:用户先通过搜索进入,几天后经朋友推荐再次访问并留资。这条线索里其实有两种不同的东西。
把它们塞进同一个“来源”字段,无论填搜索还是填口碑,都会让后续判断失真。前者会高估搜索的独立贡献,后者会让可归因数据出现无法解释的空洞。实际动作是拆字段,而不是争论哪个渠道更重要。
以你现有的线索表为对象,最小改动是增加两个字段:attributed_source 和 word_of_mouth_note。前者只接受可观察证据,后者记录口碑信息文本。
这套规则的结果是:每条线索同时保留两类信息,后续统计时你可以选择只看可归因部分,也可以单独统计口碑提及频次,而不必二选一。
小样本阶段,双字段看起来足够,因为线索少、沟通记录完整。规模化后常见例外有三类。
边界在于:双字段解决的是记录问题,不是分配功劳的问题。一旦要求“算出各占多少”,就需要额外的规则和假设,那已经超出记录来源本身。
假设某月共 100 条线索,其中 60 条有可归因来源,25 条记录了口碑提及,15 条两者都有。若你只统计可归因来源,会得到 60 条;若把口碑提及也算作来源,会得到 85 条。这两个数字回答的是不同问题,不能相互替代。
下一步动作取决于你要做什么决定:如果要评估渠道投放,只看可归因字段,并把“两者都有”的线索单独列出,避免重复计入;如果要了解口碑在成交路径中的出现频率,则单独统计口碑字段,不把它和渠道指标混在一张表里比较。先明确用途,再选字段,而不是先合并再解释。
无论表格还是系统,落地时固定三件事即可减少后续争议:可归因字段的取值枚举、口碑字段的记录格式、以及两者同时存在时的展示顺序。取值枚举防止同一渠道出现多种写法;记录格式防止口碑信息变成无法统计的自由文本;展示顺序则让读表的人先看到证据,再看到转述。做到这三点,口碑传播与可归因渠道并存时,来源记录就不会互相污染,后续分析也才有稳定的起点。