不一定。只有当两个工具各自完成了独立的采集、清洗和判断,并且你能核到来源的原始出处时,同一来源被引用两次才算两条证据;如果它们只是把同一份上游数据转手展示,那本质上仍是一条证据,只是出现了两次。
“来源相同”可能指三种完全不同的情况,结论也完全不同。
判断动作很简单:分别向两个工具追问“这条结论对应的原始记录是什么”,拿到可核对的对象(页面地址、记录编号、导出时间)后再比较。如果拿不到原始记录,只能拿到一句结论,就应当按一条证据处理,而不是两条。
有一种情况会让“同源即一条证据”的判断失效:两个工具引用同一份原始数据,但其中一个做了独立的抽样复核或人工校验,另一个没有。
假设某排名数据来自同一份公开榜单。工具甲直接展示榜单名次;工具乙不仅展示名次,还记录了该名次对应的页面在查询时是否可访问、内容是否与榜单描述一致。此时工具乙提供的是对原始来源的独立验证,而不是重复引用。两条结论虽然指向同一来源,但证据强度不同:甲只能证明“榜单这样写”,乙还能证明“榜单描述与当前页面状态一致”。
换句话说,独立性不取决于来源是否相同,而取决于是否有人在来源之外做了可复核的检验动作。没有这一步,同源引用就只是复制。
当多个角色对同一事实理解不同时,不要争论哪个工具更准,而是把分歧拆成可以逐项核对的对象。
完成交叉验证后,如果发现两个工具指向同一条原始记录且都没有额外校验,那么后续决策应把它们视为一个信息渠道,而不是两个。这时更合理的动作是寻找采集方式不同的来源,或者由自己建立一份可追溯的记录,而不是继续增加同源工具的数量。
上述判断成立的前提是:你能接触到来源层级信息,并且比较对象、时间窗口基本一致。如果两个工具都不披露数据来源,或者来源信息只存在于宣传描述中,那么“是否独立”这个问题本身就无法核实,此时应按最保守的方式处理——把它们当作同一渠道。
例外在于,当决策成本很低时,不必强求证据独立性。例如只是判断某个词是否值得进一步观察,两个同源工具给出相同提示,已经足够触发一次人工核查;但如果是需要向他人解释的重要结论,就必须回到原始记录,并说明这份记录被几个渠道引用过。
因此,下一步动作不是继续比较两个工具的界面或评分,而是挑出争议最大的一条结论,找到它的原始出处,记录核对时间和核对结果。这个动作完成后,你才能判断现有工具组合是提供了两条证据,还是一条证据被展示了两次。