交叉验证的核心不是「多听几个人说」,而是确认这些说法之间是否真的互相独立。很多人以为找到了三个信源就安全了,但如果这三个信源的源头是同一个人,那本质上还是一个信源。

第一步:把信息拆成最小的可验证单元

一条复杂的叙述里,通常混杂着事实、推测和评价。第一步要做的,是把它们分开:哪些是「某时某地发生了某事」,哪些是「所以这说明」,哪些是「这很过分」。只有第一类才需要验证。

  • 事实单元:有时间、地点、可核对的对象。
  • 推测单元:带有「说明」「意味着」这类推断词。
  • 评价单元:直接表达好恶,不需要验证。

第二步:为每个事实单元寻找独立路径

独立的意思是:两条路径之间没有共同的中间人。你可以通过不同渠道分别询问,也可以把口述与可核对的记录对照。如果所有路径最终都指向同一个最初的转述者,那就需要重新寻找。

第三步:记录差异,而不是消除差异

这是最容易被跳过的一步。当不同信源给出不一致的细节时,直觉会想挑一个相信,但更专业的做法是把差异保留下来。差异本身常常是理解事件的关键:为什么同一件事,两边的描述会不一样?

不一致的地方,往往比一致的地方更能说明问题。

一个常见的误区

很多人会把「多数人这么说」当成验证通过。但数量不等于独立性,如果十个人都在转发同一条内容,那仍然只是一条信息。真正需要统计的是独立路径的数量,而不是复述者的数量。

三步之后

走完这三步,你得到的通常不是一个干净的结论,而是一张带有确定性的地图:哪些部分已经立住了,哪些部分还需要等待。这张地图比一个斩钉截铁的答案更有用,因为它知道自己哪里还空着。