平衡开放性与怀疑态度
Linas Juozėnas分享
保持好奇。让证据引导你的信心。
平衡开放性与怀疑精神,意味着为发现留出空间,同时了解哪些主张值得你信任。
一个新想法可能令人兴奋、有用、令人不安,或者只是陌生。你可以探索它,而不必立即接受它。你也可以质疑一种解释,同时仍然对提出它的人感兴趣。
目的是更清楚地理解:有人提出了什么主张、什么支持它、哪些地方仍不确定,以及什么情况会足以让你改变想法。
愿意考虑一个想法,但要准确把握自己对它的信任程度。
开放性是愿意理解一种可能性、接触不熟悉的观点并修正判断。怀疑精神则是检验某一特定主张是否有充分依据的实践。两者可以同时发挥作用:你可能会对一个想法感兴趣,但在更好的证据出现之前,对它保持较低的信心。
不加批判地接受,会让一个主张过于轻易地被放行。笼统的犬儒主义则会在审视现有信息之前就得出否定结论。两者都可能让调查过早止步。周密的探究会在证据所允许的范围内尽可能保持问题开放,然后再形成结论。
正确的结论不必位于两个相互竞争的观点之间的中间位置。如果一种解释有强有力且相关的证据支持,而另一种只是推测,那么它们就应当获得不同程度的信心。公平地考量意味着采用站得住脚的标准,也要将这些标准用于你已经认同的主张。
好奇心
“这个想法意味着什么?研究它可能让我了解到什么?”
理解一项提议,能让你明确需要探究的内容。
辨别力
“现有证据在多大程度上支持这一特定结论?”
你的信心可以很高、很低,或尚未确定,具体取决于答案。
智识谦逊
“我的知识可能在哪些方面并不完整?什么可能会改变我的判断?”
你可以持有经过审慎思考的立场,同时认识到它的局限。
一项针对246名参与者的2024年研究发现,自我报告的智识谦逊与更好地区分真假标题有关,而不是与普遍拒绝这些标题的倾向有关。由于这项研究具有相关性,它并不能证明练习谦逊会导致这种改善。[1]
因此,一个有益的个人目标是更善于说明自己为什么信任某项主张、这种信任止于何处,以及什么情况会促使自己重新考虑。没有必要不断自我怀疑;能够修正的判断仍然可以是自信的判断。
找出信息中的确切主张
一条信息往往会把观察、解释、预测和建议结合在一起。认同其中一部分,并不能证明其他部分也成立。首先,用一句通俗的话重写事实性主张,并将其范围缩小到足以核查的程度。
例如,“这款电池具有革命性”可能指的是它的重量、成本、充电速度、续航时间或使用寿命。“它的续航时间长十倍”在明确测量的是什么以及与什么进行比较之前,仍然含义不清。
| 陈述类型 | 示例 | 有用的问题 |
|---|---|---|
| 观察 | “我的屏幕使用时间报告显示我昨天用了四个小时。” | 报告统计了什么?记录是否准确? |
| 解释 | “通知导致我不断查看。” | 是什么把通知与查看行为联系起来?还有哪些因素促成了这一结果? |
| 一般性主张 | “关闭通知会提高每个人的专注力。” | 研究了哪些人?哪些方面有所改善?这一结果适用范围有多广? |
| 预测 | “这项改变每天会为我节省一小时。” | 哪些假设支撑这一预测?我将在什么时候重新审视它? |
| 偏好或价值观 | “我希望晚间受到的打扰更少。” | 这是否体现了我希望自己的选择所服务的一项优先事项? |
个人偏好不需要科学研究才能变得合理。你可以偏好安静的夜晚、拒绝饮酒,或选择与不同的人相处,因为这更适合你的生活。然而,关于某项活动对所有人会产生什么影响的说法,则需要超越个人偏好的证据。
同样,“这次谈话后我感觉更安定了”描述的是一种体验。“这位演讲者的整套理论一定是正确的”则是进一步得出的结论。体验的价值与对其提出的解释是否准确,可以分开考量。
价值观同样会影响公共决策。研究可以阐明可能的结果和权衡,但人们仍可能对哪些结果应当优先存在分歧。明确这一点,可以把一场看似基于事实的争论转变为更诚实的讨论。
核查主张的六步方法
根据问题的重要程度采用这些步骤。常规细节可能只需简短核查;影响重大的或技术性主张可能需要更多时间和相关专业知识。这套方法是一份实用指南,并不能保证所有不确定性都会消失。
-
第 1 步 · 明确
写下对方提出的主张
保留最强烈的措辞:“导致”“总是”“翻倍”“证明”或“每个人”。询问证据需要证明的是一个事件、因果效应、预测,还是动机。
如果多个主张被捆绑在一起,选择对你的决定最重要的那个。
-
第 2 步 · 调查
不要只看信息来源自己的页面
打开另一个标签页,调查信息背后是谁。核查相关经验、资金来源、所有权,以及独立来源如何描述这项工作。同一网站上令人印象深刻的个人简介,仍然只是发布者对自己的介绍。
使用中立的搜索方式,以便既能发现有用的支持,也能发现实质性的批评。
-
第 3 步 · 追溯
找到原始材料
追溯引语至完整采访,将数字追溯至其数据集,并将研究标题追溯至研究本身。核查被引用的材料是否确实支持与之相连的那句话。
如果无法找到原始材料,就在结论中保留这一限制。无法访问会留下空缺,但并不能据此确定该主张。
-
第 4 步 · 恢复语境
核查日期、背景和范围
区分发表日期和事件发生日期。留意被省略的限定条件、对照组、相关地点,以及所研究的人群或条件。
真实的引语在被缩短后可能会产生误导。真实的图片可能被错误地附在另一事件上。较早的发现可能仍然重要,但需要考虑其年代和后续证据。
-
第 5 步 · 交叉验证
寻找独立支持
询问新增报告是否带来了新的观察结果、记录、测试或分析。多个网站引用同一份新闻稿,并不能构成多项独立确认。
还要寻找最有力的相关质疑。有效的反对意见应指出主张或证据存在的问题,并解释为什么这很重要。
-
第 6 步 · 暂作结论
说明证据能够支持什么结论
选择诸如“有充分支持”“前景可观但有局限”“尚未得到验证”或“与现有记录相矛盾”等措辞。说明主要原因,而不要只依赖标签。
明确哪些情况会改变你的判断,然后决定是采取行动、寻求帮助、等待,还是到此为止。
离开不熟悉的网站、转而在其他地方调查它的做法称为横向阅读。在一项针对87名大学生的研究中,包含这一策略的课程干预后,学生对来源的评估有所改善。该研究采用前后对比设计,没有随机分配的对照组,因此不应将其结果解读为普遍保证。[2]
追溯来源还有助于避免一种常见的计数错误。五份报告可能包含五项彼此独立的调查,也可能都只是在重复某个人的断言。要充分追溯证据,弄清楚你面对的是哪种情况。
一个有用的停止规则:当进一步搜索主要只是在重复已有内容,不太可能改变你当前的决定时,就暂停搜索。记录仍未解决的问题。新证据出现时可以再回来;你不必解决网上的每一场争论。
询问证据实际上能够确立多少内容
证据是否符合问题?
目击者的陈述可能与某人所看到的事情高度相关。文件可以确立某项政策的内容。实验室实验可以在特定条件下检验某种机制。比较各组的研究可以帮助估计某种效果。它们的用途取决于所要回答的问题。
一份亲身经历陈述可以揭示值得调查的情况,包括正式研究忽视的经历。但仅凭它通常无法确定相同结果出现的频率,也无法确定所提出的解释是否导致了该结果。
比较的是什么?
设想使用学习应用的人比不使用的人考试分数更高。该应用可能确实有帮助。但使用者也可能学习时间更长、先前知识更多,或接受了额外教学。仅凭关联无法排除这些可能性。
了解各组是如何选取的、还有哪些方面存在差异,以及研究设计能否回答所提出的因果主张。你不必亲自完成分析,也能识别出需要专家解释的问题。
差异有多大?
询问实际数值、单位和时间段。在一个假设的工厂中,将故障率从每百件两件降至一件,既是相对减少50%,也是绝对减少一个百分点。这两种说法都正确,但传达了结果的不同方面。
还要区分效果的大小与估计的精确程度。小型且波动较大的样本所显示的巨大变化,可能仍然不确定。幅度适中但估计精确的变化可能更可靠,尽管其实际重要性仍然有限。
更广泛的研究总体显示了什么?
要关注相关研究是否一致,它们对同一问题的回答程度如何,以及重要结果是否可能被遗漏。科克伦协作组织关于评估证据确定性的指南会考虑研究局限性、结果不一致、间接证据、精确性不足和发表偏倚。这些都是应当审视全貌的理由,而不是只计算有利论文的数量。[3]
综述也需要审查:研究是如何找到、筛选和评估的?一份自称综述的文件仍可能只提供有选择性的总结。
这一发现经受住了进一步检验吗?
美国国家科学院、工程院和医学院区分了使用相同数据重复分析与使用新收集的数据检验结果是否一致。其报告还解释说,一次成功的重复并不能保证结论正确,而一次失败的重复也不能彻底驳斥某项主张。方法、不确定性和累积证据都很重要。[4]
对读者而言,实际问题是:某个标题描述的是一项早期结果、一个经过反复检验的发现,还是一个在进一步调查后已经发生变化的结论。
运用专业知识,但不要放弃自己的判断
没有人能够亲自重复每项实验、查阅每份档案或精通每个专业领域。依赖他人的知识是学习的一部分。重要的是,这种依赖是否有合理依据。
相关专业知识比一般声望更重要。设计电池的经验并不会自动赋予其营养学专业知识,拥有大量受众也不能证明一个人在任何领域具备能力。要看这个人的知识是否与所讨论的具体问题相关。
有用的迹象包括:解释清晰易懂,回应有力的反方证据,明确结论的局限,并愿意纠正错误。严谨的专家应能区分领域内已经确立的事实与自己的解读或预测。
相关领域专家之间的共识可以成为暂时信任的充分理由,尤其是当这种共识反映了不同的方法和独立收集的证据时。要确认共识的范围:专家可能同意某种影响确实存在,却对其程度、解释或最佳政策应对方式存在分歧。
不同意见也值得审视。要问:批评者是否指出了一个重大的缺陷,提供了新证据,或检验了另一种解释?处于少数并不能解决问题;处于多数也同样不能。每种立场背后的理由仍然是核心。
资历
它们有助于证明相关的培训和经验,但并不能使该人士说出的每句话都正确。
同行评审
它在发表前增加了专家审查。这是一种有用的质量控制,但已发表的论文仍可能包含局限或错误。
透明度
易于查阅的方法、公开声明的利益关系以及可见的更正,为读者提供了更多评估这项工作的途径。
资金来源和利益激励值得关注,因为它们可能影响调查、强调或遗漏的内容。经济利益是促使人们更加仔细检查保障措施和独立核查的理由;但它本身并不能证明某项发现是错误的,也不能证明存在不诚实行为。
同样的公平标准适用于各类机构和独立发声者。大型组织也会犯错。不熟悉的观察者也可能提供重要证据。评估其贡献时,不要让来源的地位替你完成全部推理。
学会不只说“真”或“假”
有时,证据支持一个明确的答案;另一些时候,证据支持的是更狭窄的表述、一系列可能性,或暂缓决定。 当你说明不确定的内容及其原因时,不确定性会变得更有用。
你可能确信某件事确实发生了,却不确定其动机。你可能接受某项技术帮助了受研究者,同时质疑它是否会在不同环境中发挥作用。你可以调整对估计影响大小的判断,而不必放弃“影响确实存在”这一结论。
| 评估 | 所传达的信息 | 可能的措辞 |
|---|---|---|
| 有充分支持 | 有力且相关的证据在规定范围内支持该主张。 | “在这些条件下,证据使我有充分理由接受这一点。” |
| 暂定 | 有实质性支持,但仍存在重要限制。 | “这似乎很有希望,但结果还需要进一步核实。” |
| 尚未解决 | 现有证据无法解决这个问题。 | “根据现有信息,我无法可靠地判断这一点。” |
| 缺乏支持 | 尚未提供或发现足够的支持性证据。 | “目前,我没有充分依据接受这一主张。” |
| 相互矛盾 | 相关证据对该主张不利。 | “现有记录与这一解释相矛盾。” |
这些是非正式的描述,不是数值评分体系。 应将它们与理由联系起来。“由于原始文件无法获得,因此尚未解决”比简单地说“任何事情都有可能”传达的信息更多。仅有可能性并不能告诉你某种解释有多大可能。
缺失的证据需要结合背景来理解。 如果一项主张预言会出现明确的信号,而可靠的测试反复未能发现该信号,那么这种缺失可能会对该主张不利。 如果没有人开展过适当的调查,缺乏结果所能说明的就少一些。 问问自己:如果该主张正确,应当存在什么证据,以及你发现这些证据的可能性有多大。
也将这个问题应用于你自己的立场。如果不存在任何可能改变你结论的观察,请考虑你是在评估一个经验性声明,还是在保护某种立场不受审视。有些问题涉及意义或价值;这类问题需要不同的讨论。
改变想法并不意味着必须转向相反的极端。你可以降低确信程度、缩小声明的范围,或接受其中一部分而否定另一部分。根据新证据实际影响的部分进行更新。
检查标题、图片或 AI 回答背后的内容
注意其中的压力,不要把情绪当作裁决
一条消息可能会激起愤怒、希望、恐惧、归属感,或拥有特殊知识所带来的满足感。注意它是否催促你立即分享、在核查前花钱,或把每一个问题都视为不忠。
这些特征是让你放慢脚步、仔细审视声明的理由。情绪化的语言并不能证明内容虚假:真诚讲述伤害经历的人可能会愤怒或痛苦。冷静的措辞和专业的设计也不能证明内容真实。评估其底层材料。
一个有用的问题是:“如果结论令我失望,我还会接受这份证据吗?”它有助于揭示你的标准是否会随着你想听到的内容而改变。
还原视觉材料的上下文
对于引人注目的照片或短视频,寻找最早可获得的版本、地点、日期,以及片段前后发生了什么。反向图片搜索可能有助于找到更早出现的版本,但找不到匹配结果并不能证明图片真实。
检查图表的坐标轴、单位和时间范围是否支持标题中的结论。由于比例尺的原因,一条线可能看起来变化剧烈。截图可能省略改变对话含义的回复。要区分内容真实的材料与对其进行的准确解读。
核实 AI 生成的参考资料和事实细节
AI 工具可以帮助整理问题、解释术语,并为进一步阅读提供方向。表达流畅的输出仍需核查。美国国家标准与技术研究院(NIST)关于生成式 AI 的指南将自信呈现的虚假内容(包括捏造的佐证材料)列为风险,并建议核实来源和引文。[5]
打开一项重要 AI 生成声明背后的原始来源。确认该文件确实存在,作者和日期无误,并且相关段落支持该说法。真实的引文也可能被附在一个原文从未提出的声明上。
向多个系统提出同一个问题可能会暴露出分歧,但达成一致并不能证明存在独立确认。它们可能依赖重叠的材料,或重复同一个错误。下一步有用的做法是检查生成式回答之外的证据。
受欢迎程度回答的是另一个问题。浏览量、点赞、转发和搜索曝光度能告诉你一些关于关注度的信息。要判断准确性,请查找该主张背后的记录、方法和推理。
区分考虑、相信、分享和行动
你可以阅读一项陌生的提案,而不代表认可它。你可以认为某件事具有 plausibility,同时拒绝将其作为事实重复传播。在根本原因尚未完全理解之前,你也可以先采取合理的预防措施。
适当的判断门槛取决于判断错误的后果、等待的成本、可用的替代方案,以及该决定是否可以撤销。一项主张是否为真,并不会因其利害关系而改变;但在据此采取行动前,你需要进行多少核查,可能会有所不同。
探索
阅读一项提案或询问其运作方式,可能只是适度的投入。在了解的过程中,明确保持其事实状态。
分享
在向他人陈述一项主张之前,检查其措辞是否与证据相符。明确说明哪些内容已经核实,哪些尚未核实。
行动
当一项决定可能对健康、财务、安全或他人的声誉产生重大影响时,应进行更仔细的核查。相关专业建议可能是你所需证据的一部分。
研究表明,人们决定分享什么内容时,注意力本身可能会产生影响。2022 年对 20 项随机实验的分析发现,准确性提示提高了参与者在分享意愿方面区分真假标题的能力。这些结果主要涉及研究环境中的分享意愿;它们并不能证明提醒会永久改变人们的日常行为。[6]
一种实际做法是在转发前先问一句:“我核实过这件事了吗,还是我只是希望它是真的?” 对于涉及可识别个人且未经核实的指控,与其加上一句含糊的免责声明后传播,不如暂不转述这项指控。
你不需要确定某人的意图,就可以拒绝令人不适的请求或设定合理的界限。同样,对日常安排进行一次小幅、低风险的调整,可以帮助你了解自己的偏好,而无需据此对其他所有人做出普遍性结论。
仔细审视四种日常情境
以下情境均为假设。每个情境都展示了好奇心如何引出下一个有用的问题,而不必立即下结论。
“这款电池的续航时间长十倍。”
这条标题很吸引人,但“更持久”可能指两次充电之间的时间更长,也可能指电池在性能衰退前可完成的充电循环次数更多。原始研究描述的是一个在特定条件下进行测试的小型实验室电池。
你会核查对比对象、测试条件,以及是否有独立团队评估过类似性能。你还会区分实验室发现与关于成品设备成本、生产和性能的说法。
适度的结论:这一结果在技术上可能很重要,但关于日常产品的说法仍未得到证实。继续关注后续进展是合理的。
“五篇文章都说这种方法能提高注意力。”
顺着链接查看后发现,五篇文章都引用了同一家公司的公告。公告说明,这是一项针对主动选择回应的客户进行的调查。
你会查找所提出的问题、受访者的数量和选择方式、改进是如何衡量的,以及是否存在独立的比较。客户报告可能有助于了解这些受访者的经历,但对更广泛的有效性仍无法确定。
适度的结论:这项说法得到了反复宣传,但你只找到了一个根本来源。更多报道尚未提供更多独立证据。
“他们把我排除在外,所以他们一定想让我离开。”
某人被遗漏在两次会议之外,因此感到不受欢迎。这些遗漏及其影响值得关注。提出的动机则是另一个问题。
在对方参与的情况下,你可以审视邀请、解释以及某种模式是否持续。行政失误、角色变更和蓄意排斥需要不同的解读。不能仅仅因为某种情况可以想象,就认定它确实如此。
适度的结论:认真对待这段经历,澄清发生的事情,并支持合理的界限。关怀不必等到所有动机都得到确认后才开始。
“这个群体帮助了我,所以它的整套解释一定是正确的。”
一个群体在某人改变不良习惯的过程中提供陪伴。这种支持很重要。但该群体也在推广关于人们为何陷入困境以及每个人应该相信什么的宽泛说法。
你可以珍视这份陪伴,同时分别核查这些说法。考虑一下:是否欢迎提问,人们能否维持外部关系,以及参与其中是否仍为个人选择留有空间。
适度的结论:善意和有用的支持是互动中有意义的特征,但它们不会自动证明附带的每一项教导都正确。
提出探索性问题,但不要把它们变成攻击
有益的讨论始于理解对方实际在说什么。先问问对方是在分享一段经历、提出一种解释、表达一种偏好,还是寻求帮助。把这四种情况都当作科学论证来回应,可能会忽略重点。
试着用对方能够认同的方式复述这一主张:“你注意到那件事发生后出现了这一变化,并认为两者有关联。我的理解对吗?”然后,如果对方愿意进行这样的对话,就和对方一起审视这种关联。
问题可以直接而尊重他人:
- “哪些部分是你亲自观察到的,哪些部分来自其他来源?”
- “我们能一起查看原始材料吗?”
- “是什么让这一解释比其他解释更令人信服?”
- “什么证据会增强或削弱这一结论?”
- “这就是会改变我自己看法的事情。”
当有人描述自己受到伤害时,对某种解释的不确定,并不会抹去这种经历,也不应让获得支持以完美的文档为条件。在事实问题尚未解决时,一个人可能需要倾听者、实际帮助,或自主做决定的空间。
欺诈、隐瞒和滥用权力都可能发生。具体指控应通过相关记录、证词和相互印证的材料进行查验。可能存在某种动机,并不能证明不当行为确实发生;记录不完整,也不能证明什么都没有发生。让结论始终局限于现有证据能够支持的范围。
公平探究也有边界。没有人必须应所有要求者之请,进行无休止的辩论或提供私人信息。如果问题在得到回答后反复改变,可以就某一项主张以及什么才算充分回答达成一致。如果交流变得强迫性十足或毫无成效,暂停是合理的。
当你发现自己分享了一个错误时,清楚地更正具体表述。解释发生了什么变化,并在可行时将更正发布在原受众能够看到的地方。这样做的有益结果,是让大家形成更准确的共同理解。
为提问留出空间,也为继续前行留出空间
选择一个与实际决策相关的重要主张。你可能正在评估一种学习方法,考虑有关改掉某个不良习惯的建议,或在重复某项断言之前核实它。简短记录可以让你的推理更容易被复查。
简短的反思指南
- 确切主张:要求我相信的究竟是什么?
- 最有力的支持:我实际核查过哪些证据?
- 主要局限:还有哪些不确定之处,或有哪些因素不利于这一判断?
- 我目前的判断:我有多大把握,为什么?
- 下一步决定:我将做什么?哪些新证据会让我重新考虑?
偶尔回头审视自己早先的判断。事情的发展是否如预期?你是否忽略了相关的比较?是否因为喜欢信息来源,就改变了自己的标准?利用答案来改进某个具体的探究习惯。
让好奇心在争论之外也有一些空间。学习一项技能,阅读来自其他领域的严谨解释,或者询问他人是如何形成一个你不熟悉的观点的。理解不必以达成共识告终,它本身就值得。
在改变习惯的过程中,这些技能能帮助你评估建议,同时牢记自己的目标。一种方法可能值得探索,但未必是普遍适用的解决方案。一个支持你的人可能会有所帮助,但不必替你决定一切。你可以保留有用的部分,质疑不清楚的内容,并在学习过程中不断调整。
更多反思内容见自我反思工具和批判性探究的核心原则。系列介绍将这些问题置于习惯、能动性和改变等更广泛的主题之中。
资料来源与延伸阅读
这些精选研究和方法资源支持上述研究主张。资料已于 2026 年 9 月核查。核查方法、反思提示和假设情境属于教育应用;它们不是经过验证的评估工具,也不是系统综述。
- Prike T、Holloway J、Ecker UKH。智识谦逊与更强的错误信息辨别能力和元认知洞察力相关,但与反应偏差无关。advances.in/psychology。2024 年;2:e020433。对新闻标题判断进行的原创相关性研究;支持区分辨别能力与不加区分的不相信。返回正文 ↑
- Breakstone J、Smith M、Connors P、Ortega T、Kerr D、Wineburg S。横向阅读:大学生在在线课程中学习批判性评估互联网来源。哈佛肯尼迪学院错误信息评论。2021 年。采用前后测评的原创教育干预研究;没有随机对照组。返回正文 ↑
- Cochrane。第14章:完成“结果摘要”表格并评定证据的确定性。《Cochrane干预措施系统综述手册》。关于如何根据某一特定结局的一组证据评判证据确定性的方法学指南。返回正文 ↑
- 美国国家科学、工程与医学研究院。科学中的可重复性与可复现性:摘要。美国国家科学院出版社。2019年。关于重复分析、独立测试、不确定性以及如何解读复现结果的共识报告。返回正文 ↑
- 美国国家标准与技术研究院。人工智能风险管理框架:生成式人工智能简介。NIST AI 600-1。2024年。官方指南,介绍人工智能自信地生成错误输出的情况,以及核实来源和引文的必要性。PDF。返回正文 ↑
- Pennycook G,Rand DG。准确性提示是减少错误信息传播的一种可重复且具有普适性的方法。《Nature Communications》。2022年;13:2333。对20项随机实验进行的内部荟萃分析,主要考察分享标题的意愿。返回正文 ↑