Pretrained Data and Biases

预训练数据和偏见

Knowledge Ark · 成瘾与解放

审视你带来的那些假设。

我们带着一段经历面对新信息:我们学到的东西、信任的人、记得的经历,以及可能从未用语言表达过的预期。

这段经历有助于我们理解某种处境。它也可能让一个假设未经检验,使一种熟悉的解释显得格外有说服力,或让某人的身份地位获得超过其证据应得的分量。

学会注意到这些影响,会为你提供一个实用的起点:找出这个信念,审视支持它的依据,并决定它如今值得多大程度的信任。

谨慎使用这一比较

“预训练数据”是对既往学习的比喻

在本文集中,“预训练数据”是一种非正式说法,用来描述我们带入新情境的经历、知识和预期。它不是临床诊断,也不是公认的心理学类别。

这种比较有其局限性。人拥有身体、人际关系、不断变化的处境和亲身经历的历史。人类的学习贯穿一生,不能简化为向机器中载入一个固定数据集。只有当这个比喻能帮助我们提出更清晰的问题时,它才有用。

例如,想象你进入了一个工作场所,并且认为寻求帮助意味着能力不足。你可能是在上一份工作中形成这种预期的。在当前团队中,尽早求助或许会受到欢迎,因为这样可以避免延误。原来的预期是可以理解的,但需要在新的环境中加以检验。

两个问题应当放在一起考虑:“我是如何开始相信这一点的?”以及“现在有什么支持我相信它?”第一个问题涉及信念的形成历史,第二个问题涉及它目前的依据。

从父母那里学到的想法可能是正确的。你独立形成的想法也可能是错误的。熟悉程度、新颖性和社会来源都不能决定一个主张是否为真。

你也不必为了证明独立而抛弃一种传统。经过反思后,你可以保留它、改变其中一部分,或选择其他做法。真正有用的结果,是形成一个你能够解释、并能在情况或证据发生变化时重新考虑的立场。

审视信念背后的经历

期待通过多种类型的经历逐渐形成

人们既可以通过观察他人学习,也可以通过直接指导和自身经历学习。关于观察学习的心理学理论研究行为如何因观察而改变,以及这种变化如何与一个人的学习经历和所处情境相关。看到某个行为,并不意味着每个人都会照做,或形成对它的相同看法。[1]

当你探究某个具体假设时,可以考虑几种可能的路径。下面的例子展示了可以调查的问题;它们并不能诊断你自己的信念是如何形成的。

你看到的情况

如果你参加的每次会议都由资历最高的人主导,你可能会逐渐期待发言主要是他们的职责。看到另一个团队邀请大家提问,则可能提供不同的例子。

人们怎么说

“我们一直都是这样做的”或“可靠的人从来不会拒绝”之类的说法,直接表达了期待。问问自己,它们描述的是实际要求、偏好,还是一种假设。

之后会发生什么

赞扬、取笑、排斥或有帮助的回应,都可能成为你对某种行为经历的一部分。在预测每个人都会作出同样反应之前,先记录你实际得到的回应。

其他影响因素具有现实性。最近的商店可能决定你在哪里买食物。轮班安排可能决定你什么时候吃饭。家庭责任可能限制你能参加的活动。除了关于什么是正常的看法之外,这些情境也值得关注。

同一个家庭或文化中的人也可能意见不一。不同的世代、友谊关系、工作场所和个人经历,可能支持不同的期待。“我的文化认为……”往往需要更准确地说明你指的是哪些人、哪种做法和哪种情境。

试着这样写:“在我记得的那些情境中,这种回应很常见。”这为其他经历留出了空间,同时也不会否定你曾有过的经历。你可以承认是什么塑造了某种期待,同时检视它适用的范围。

弄清楚你正在作出哪一类陈述

惯常做法、期待和充分理由可能并不相同

社会规范研究中的一个有用区分,是将我们认为他人通常会做的事,与我们认为他人认可或期待的事区分开来。这两类规范通常称为描述性规范和命令性规范。联合国儿童基金会的指南还将这类社会期待与个人态度以及由其他情境驱动的行为区分开来。[2]

一次对话中可能出现几种不同类型的陈述。区分它们有助于你选择恰当的问题。

需要不同类型检视的五种陈述
陈述类型 假设性示例 有用的问题
感知到的常见做法 “这里大多数人都用葡萄酒碰杯。” 我观察过哪些人和场合?
感知到的社会期待 “如果我拒绝,他们会觉得我很无礼。” 人们实际说了什么或做了什么?
个人偏好或价值观 “我喜欢参加庆祝活动。” 哪些部分对我最重要?
事实性主张 “这种饮料能改善睡眠。” 有哪些相关研究支持这一主张?
正式规定 “组织要求必须出席。” 实际政策要求什么,以及适用于哪些情况?

频繁发生并不能证明安全、公平或有用。一种做法可能很常见,但仍值得审查。同样,一种不寻常的偏好也不必先成为普遍规则,你才能表达它。

我们对群体的印象可能是错误的。在1993年发表的四项研究中,普伦蒂斯和米勒发现,学生往往认为自己比普通学生更不适应校园饮酒习俗。这说明了多元无知:人们自己的观点与他们所假定的他人想法之间存在不匹配。这项研究是在美国某所大学的特定环境中开展的,并不是对所有社区的描述。[3]

在接受“每个人都想要这个”之前,先问问是否每个人都有机会作答。沉默、参与和赞同是不同的观察结果。有人可能因为没有其他选择、想避免争论,或者只喜欢活动的一部分而参与其中。

留意你如何选择和评估证据

确认偏误会让一个信念更容易被辩护,而不是被检验

确认偏误描述的是人们倾向于偏好支持既有信念或预期的信息。它可能出现在我们提出的问题、选择的来源以及评估答案时采用的标准中。

想象一下,你认为加班到很晚是投入程度最明显的标志。你注意到一位同事加班到很晚,并完成了一个出色的项目。对于另一位在正常工作时间内交付优秀成果的同事,你却较少关注。两种情况都与这一主张有关,但只有一种容易符合你的解释。

选择性搜索

你寻找现有做法有效的理由,找到一篇令人振奋的文章后就停止了。试着换一种方式提出问题,让多个可能的答案都保持开放。

审查不均

一项支持你观点的小型研究似乎很有说服力;一项提出质疑的类似研究却显得范围太有限。问问自己:同样的局限在两种情况下是否都重要。

选择性示例

成功的案例很容易描述,但你没有记录不成功的尝试或普通结果。检查一下你的例子遗漏了什么。

在一项经典实验中,Lord、Ross 和 Lepper 请48名持有相反死刑观点的本科生评估两份结论相互冲突的虚构研究报告。参与者通常会更积极地评价支持自己原有立场的报告。研究人员调换了哪种方法得出哪种结论,从而有助于揭示结果如何影响参与者对方法的判断。这说明,在特定任务中,人们会带有偏见地进行评估;但这并不表明证据总会让人更加固守己见。[4]

拒绝薄弱证据是恰当的。需要关注的是:如果结果支持你的立场,你是否也会识别出同样的薄弱之处。平衡的过程仍然可以得出这样的结论:一个主张获得的支持远强于另一个主张。

防御性反应也不能证明存在确认偏误。对方可能很疲惫、产生了误解、担心后果,或是在回应真正的侮辱。在赋予其心理学解释之前,先考察推理过程和背景。

找出问题消失的步骤

信念会影响你能够观察到哪些经历

有时,一种预期会以限制检验机会的方式影响你的行动。请考虑这个虚构的例子:某人认为,在会议上提问会让自己显得准备不足。

  1. 1 · 预期

    “提问会让我显得无能。”

    当事人带着一个假设进入会议。这个假设可能反映了他们过去的经历,但尚未在这个团队中得到检验。

  2. 2 · 反应

    他们保持沉默。

    他们避免了预想中的不适。因此,这次会议几乎没有提供关于同事会如何回应合理问题的直接证据。

  3. 3 · 所选的观察

    他们注意到另一位沉默的同事。

    这片沉默似乎证实了这一预期。同事保持沉默的实际原因仍然未知。

  4. 4 · 结论

    “显然,没人应该提问。”

    一个未经检验的解读开始听起来像一条既定的群体规则。当事人带着同样的预期进入下一次会议。

其中有几个环节适合进行有益的检验。当事人可以询问团队倾向于如何处理问题,观察有人请求澄清时会发生什么,或者在自己感到自在的场合提出一个容易处理的问题。

结果并不确定。团队可能欢迎提问,也可能反应不一致,甚至确实不鼓励提问。如果环境会惩罚合理参与,那就是有关该环境的信息。仅靠私下反思无法改变组织的激励机制或行为。

审视这一过程能让问题保持具体:我预測了什么,我做了什么,有哪些证据出现了,以及我得出了什么结论?

让信心程度与相关能力相匹配

相信专业能力,同时审视它所支持的内容

在日常讨论中,权威偏误通常指因为说话者的身份而过度重视某项陈述。头衔、声誉或自信的表达方式,可能会让一项主张在其与证据的联系尚未经过检验之前,就显得已经确定无疑。

相关专业知识是认真对待某个来源的正当理由。我们依靠专家,是因为没有人能够独立重复每一项实验、检查每一座建筑或掌握每个领域。

美国国家科学院关于科学传播的报告指出,人们(包括研究领域不在相关专长范围内的科学家)会依靠可信来源来解读和验证信息。报告还区分了他人感知到的专业能力与实际资历,并讨论了能力、正直和可靠性在信任中的作用。[5]

让信任更具体的问题
核查 询问 为什么这很重要
相关领域 哪些经历或培训与这个具体问题相关? 在一个领域的能力不会自动迁移到另一个领域。
证据 哪些观察、方法或研究支持这项陈述? 一项主张的依据越清晰可见,就越容易评估。
适用范围 这个结论适用于哪些人,以及哪些情况? 关于某一群体的发现,未必足以为所有人提供建议。
独立评估 其他合格来源如何评估这些证据? 转发同一个人的说法好几次,并不能提供多少独立核查。
不确定性与纠正 哪些内容仍不确定,错误又是如何得到纠正的? 有用的来源能够解释局限,并修正答案。

厨师可能会在冲煮咖啡方面提供很好的指导。但这并不自动意味着他们个人的咖啡因摄入习惯适合作为给每位观众的健康建议。临床医生的专业知识也有适用范围;谨慎的回答可能需要核查证据或咨询其他专科。

财务利益应当披露并接受审查,但获得报酬本身并不能证明一项陈述是虚假的。要看其方法、发现和结论是否经得起检验。对你敬佩的来源和你不喜欢的来源,采用同样的标准。

不同角色可以提供不同的信息。一个人的经历能告诉你某种做法对他们产生了怎样的影响。专家可以帮助评估更广泛的证据。在决定如何利用这些信息时,你的价值观和处境也很重要。

把同样的问题转而问问自己的推理

知道各种偏误的名称,并不会让我们对它们免疫

一旦了解了确认偏误,就很容易发现别人论证中的相关例子。你自己的结论可能仍会让你觉得,它显然是经过仔细推理得出的。

Pronin、Lin 和 Ross 在关于偏见盲点的研究中考察了这种不对称性。参与者常常认为自己比作为比较对象的人更不容易受到所描述偏见的影响。这些发现涉及自我认知和特定任务;它们并不能证明每个人都有相同的偏见,也不能证明每个自信的判断都是错误的。[6]

一种实际做法是让你的检查过程变得清晰可见。“我持开放态度”很难评估。“我寻找了可能挑战这一解释的证据,并对两种结果采用了相同的质量检查”则描述了某种可以复核的做法。

要问自己的三个问题

  1. 我最希望哪种结果为真?这是否影响了我搜索的方向?
  2. 如果这种方法或论证支持的是我不喜欢的结论,我会接受它吗?
  3. 什么具体观察可能促使我缩小、修正或放弃我的主张?

避免将偏见话语变成一种 dismiss 对方的方式。“你只是受到了条件影响”并没有触及主张本身。“这个结论只使用了一个成功案例,却遗漏了未成功的尝试”则指出了一个你们双方都可以检验的缺口。

考虑对方可能掌握你所缺少的信息。分歧可能涉及不同的证据、定义、限制条件或优先事项。在解释某人为何这样想之前,先确认你理解了对方实际表达的内容。

将模糊的意图替换为可重复的流程

让你的检查具体到足以改变探究方向

“保持客观”是合理的意图,但它没有告诉你下一步该做什么。一个有用的检查过程会明确主张,让替代解释得到公平检验,并明确证据标准。

在两项实验中,Lord、Lepper 和 Preston 发现,与笼统要求人们做到公平且不带偏见相比,提示人们考虑相反可能性对纠正偏见判断的效果更大。这支持在这些任务中提出一个具体的检查问题,但并不意味着能永久治愈偏见。[7]

  1. 检查 1

    写出可回答的主张

    将“这个流程最好”替换为关于特定结果和情境的陈述。“这种会议形式有助于我们的团队及早发现问题”可以更直接地检验。

  2. 检查 2

    说明什么情况会对其构成反证

    在开始搜索前,先确定一个相关观察。如果问题总是在会议结束后才被发现,这可能会挑战你对该形式所能实现效果的解释。

  3. 检查 3

    比较合理的解释

    一个成功的项目可能反映了会议形式、经验丰富的团队、更简单的任务,或几个因素共同作用。思考哪些信息可以帮助区分这些可能性。

  4. 检查 4

    使用相同的质量检查

    看看信息是如何收集的、比较了什么,以及缺少什么。当你设想结果支持另一种立场时,检查你的评估是否会改变。

  5. 检查 5

    追溯主张的来源

    在实际可行时,沿着摘要追溯到原始报告。核实多篇文章是否在重复同一来源,以及原始结论是否比标题所暗示的范围更窄。

  6. 检查6

    记录一个恰当程度的结论

    你可以保留这一信念、对其加以限定、暂缓判断,或改变想法。写下证据所支持的结论,以及仍未解决的问题。

结果可能取决于提示语和结果本身。在一项使用虚构且相互冲突的健康研究摘要的2023年研究中,要求参与者用相反的结果来判断相同的方法,减少了偏见性同化,但并未显著改变测得的前后态度变化。在另一项研究中,列举可能的缺陷并未减少偏见性同化。核查练习可以帮助判断中的某一个部分,但不一定会改变判断的每个部分。[8]

考虑一种替代观点,并不要求赋予它同等的可信度。未经支持的主张不会因为与您的观点相反,就变成有力的证据。选择可信的质疑,并检验其内容。

如需更详细的论证评估方法,请继续阅读 批判性探究的核心原则。

让问题清晰到足以展开讨论

质疑一种做法,而不要评判整个群体

某种习俗可能承载着记忆、待客之道、信仰、友谊或延续感。讨论改变时,要明确指出你想重新考虑的是哪一部分。“我希望今年降低礼物预算”比“我们的传统不理性”更加具体。

先确定是否存在共同目的。如果大家都希望聚会让人感到宾至如归,可以询问哪些安排有助于实现这一目标,哪些安排会造成可以避免的压力。人们可能在乎同一个目的,却偏好用不同方式来表达。

询问这种期待

“这是每个人都更喜欢的安排,还是我们只是一直这样做,却从未讨论过?”给人们留出表达自己确实喜欢这种安排的空间。

陈述你自己的立场

“我想参加庆祝活动,但这样的消费水平对我来说不可行。”即使其他人的经济条件不同,实际可行的限额仍然是相关信息。

提出一个具体的可能方案

“我们能否商定一个适度的限额,或者交换一些自制的东西?”具体的提议能让人们有明确的内容可供评估。

留意区分事实上的分歧与价值观上的差异。“这更便宜”可以核实。“我更喜欢正式的餐食”表达的是一种偏好。这场对话可能既需要基于实际情况的协商,也需要证据。

同样愿意听取这样的意见:某项改变会带来你未曾考虑的困难。询问这些困难,但不要把它们视为改变不可能的证据。

在设定个人界限之前,你不必先就某种习俗的历史展开争论并赢得胜利。如果一个明确表达的界限一再被忽视,就描述发生了什么,并决定你需要什么支持或不同的安排。更多解释并不总是下一步最有用的做法。

将这些区分带入日常决策

三个检验熟悉假设的示例

这些示例都是虚构的。每个示例都提出了不同的问题:一种社会期望是否为大家共有,地位是否能支持某个主张,以及个人经历是否足以证明因果关系。

示例 A · 家庭期望

“每个人都想要昂贵的礼物。”

莉娜感到有压力,觉得应与之前庆祝活动中互送的礼物看齐。她以为,礼物小一些就表示不够在乎。

检查:她会询问家人喜欢这种交换方式的原因,并在下一次节日前提出一个消费限额。

结果:几个人欢迎这一限制;有一个人更喜欢原来的安排。这个家庭开始讨论一个此前一直被当作全家一致同意的选择。

启示:表面上的参与并不能反映每个人私下的偏好。提出询问获得了靠猜测无法获得的信息。

示例 B · 工作场所中的权威

“资深人士一定是对的。”

托马斯听到一位经验丰富的经理推荐一种新的排班系统。她的经验确实相关,但这一主张涉及的是一个与她之前负责的团队职责不同的团队。

检查:他会询问该系统解决了什么问题、哪些证据表明情况有所改善,以及这里是否具备相同的条件。

结果:团队确定了有用的功能,并同意进行一次范围有限的试用,同时设定明确的评估标准。

启示:经理的知识为决策提供了参考,同时该提议仍应接受审查。

示例 C · 咖啡与睡眠

“熟悉的日常习惯不可能是原因。”

米尔达难以入睡,却因为自己已经摄入咖啡因多年而排除了咖啡因这一可能性。一位她喜欢的创作者也在宣传咖啡是提高效率的必需品。

检查:她会结合日常生活中的其他变化,查看咖啡因的摄入量和时间安排,并参考可靠的健康指导。

结果:她将“这不可能是咖啡因”修正为“咖啡因可能是一个值得评估的促成因素”。如果睡眠问题持续存在,她会寻求专业建议。

启示:无论是熟悉感,还是创作者的个人经历,都不能确定她所处情境中究竟发生了什么。

以咖啡因为例,美国食品药品监督管理局将睡眠问题、焦虑和其他影响列为咖啡因摄入过量的可能迹象,指出人们的敏感度存在差异,并建议想要减少摄入量的经常饮用者逐步减量。短暂的“排毒”并不能可靠地检验单一原因:戒断反应和其他变化都可能影响一个人的感受。[9]

个人观察可以帮助你提出更好的问题,但多个因素可能会同时发生变化。让结论保持在观察所允许的最小范围内。有关这一物质的具体讨论,请参阅 咖啡因:“可接受的”兴奋剂——深入探讨。

让结论符合你了解到的情况

改变你的信心程度就足够了

修正信念并不总意味着从完全认同转向完全否定。很多时候,有用的变化涉及适用范围:“这对所有人都有效”变成“这在那些情况下有所帮助,而我还不知道它的适用范围有多广。”

将三个决策分开:你认为何为真、你有多大把握,以及采取什么行动合理。你可能不确定某种惯例为何没有帮助,但仍然可以决定它的成本对你来说过高。

核查一个信念可能产生的几种合理结果
结果 你可以这样说 接下来会怎样
保留它 “相关证据仍然支持这一结论。” 说明依据,并对重要的新信息保持开放态度。
缩小范围 “这似乎适用于这种情境,但有这些限制。” 避免将主张扩展到证据范围之外。
降低信心 “我忽略了一个合理的替代解释。” 找出有助于区分这些可能性的信息。
暂缓判断 “我没有足够可靠的信息来作出决定。” 选择适当的下一步,但不要假装确定。
改变它 “证据与核心主张相矛盾。” 更新结论以及依赖该结论的任何决策。

一个可信的反例可以反驳“这里没有人欢迎提问”这样的绝对陈述。但它不能证明相反的绝对陈述,即每个人都总是欢迎提问。数量、条件和例外都很重要。

同样,多数人的观点并不自动正确,少数人的观点也不自动具有洞察力。比较证据的质量、相关性和独立性。有充分依据的专家共识,应当与一组毫无依据的断言区别对待。

让投入与决策相匹配。低成本的偏好可能只需少量调查。重大的健康、财务或安全决策可能需要相关专业建议。你可以练习独立判断,同时认识到自身知识的局限。

提出一个信念供复核

使用一份简短的记录,便于日后查阅

选择一个可处理的主题:一种会议习惯、一项消费预期,或一个关于某人会如何回应的假设。避免一开始就提出宽泛到无法判断什么证据能够回答的问题。

以下提示是一项教育练习,并非经过验证的心理评估。写下几行,并让未回答的问题保持可见。

七个问题的信念复盘

  1. 论断是什么? 将其概括为一句话,并明确情境和范围。
  2. 我在哪里遇到过它? 记录相关人员、经历或来源,但不要假定只有一个原因。
  3. 目前有什么支持它? 区分观察、研究、证词和偏好。
  4. 什么因素对它构成挑战? 在支持性证据中纳入可信的反例和局限。
  5. 我是否使用了一致的标准? 思考一下,如果结论不同,同样的证据是否仍会说服我。
  6. 还有哪些不确定之处? 指出缺失的事实、另一种解释或价值判断。
  7. 接下来我会做什么? 保留、限定或修正这一信念;提出问题;寻求建议;或暂缓决定。

在进行相关交谈或有了新的观察后,回到记录中。比较你的预期与实际发生的情况。如果没有出现新信息,就不必为了获得确定感而重复分析。

如果你与他人一起探讨这个问题,请让对方指出一个缺失的步骤或一个合理的替代解释。有效的交流应让双方都能澄清、提出异议并修正自己的立场。

继续阅读自我反思工具,获取日记提示和情绪事件记录表。若要在考察新论断时避免陷入轻信或一概不信,请阅读在开放与怀疑之间取得平衡。

研究与延伸阅读

来源及其论断的局限

下列研究考察了特定样本、任务和结果。它们有助于解释判断的可能模式,但不能根据一次分歧诊断某个人的动机或推理。本文中的示例和练习仅供说明。

  1. Fryling、Johnston 和 Hayes,2011年。 《理解观察学习:一种互行为主义方法》. 《言语行为分析》, 27, 191–203.关于观察学习及其与学习历史和情境关系的理论讨论。返回讨论 ↑
  2. 联合国儿童基金会,2021年。 定义社会规范及相关概念(PDF)。区分感知到的行为、感知到的认可、个人态度以及对行动的其他影响因素。返回讨论 ↑
  3. Prentice和Miller,1993年。 多元无知与校园饮酒. 《人格与社会心理学杂志》, 64(2), 243–256.四项研究考察了学生自身的态度及其对同龄人态度的估计;结果涉及特定的社会环境。返回讨论 ↑
  4. Lord、Ross和Lepper,1979年。 偏见性同化与态度极化(PDF)。《人格与社会心理学杂志》,37(11),2098–2109。一项使用构造的相互冲突报告来考察先前态度如何影响证据评估的研究。返回讨论 ↑
  5. 美国国家科学院、工程院和医学院,2017年。 科学传播的复杂性,载于有效传播科学。讨论科学信息的解读、专业知识、信任与可信度。返回讨论 ↑
  6. Pronin、Lin和Ross,2002年。 偏见盲点:对自我与他人偏见的看法. 《人格与社会心理学公报》, 28(3), 369–381.关于人们认为自己和他人容易受到偏见影响程度的研究。返回讨论 ↑
  7. Lord、Lepper和Preston,1984年。 考虑相反情况:一种用于社会判断的纠正策略. 《人格与社会心理学杂志》, 47(6), 1231–1243.两项实验比较了对替代方案的具体考量与更为笼统的指示。返回讨论 ↑
  8. Greitemeyer,2023年。 提出反向解释并考虑相反情况. 《应用社会心理学杂志》.两项研究表明,纠正性提示对证据评估的影响可能不同于对态度变化的影响。返回讨论 ↑
  9. 美国食品药品监督管理局。 咖啡豆大揭秘:多少咖啡因算过量?关于咖啡因敏感性、过量摄入的可能影响以及逐步减少摄入的指导。返回讨论 ↑
带着你的经验,同时留有学习的空间

熟悉的信念可以成为经过深思熟虑的立场。

你的经历为你提供了一个起点。你可以审视一个假设,认识到有益的传统,信任相关领域的专业知识,并在证据要求时修正结论。先从一个你能清晰描述的主张,以及一个能够增进理解的问题开始。

返回顶部 ↑

返回博客