Emotional, Social, and Cultural Perspectives on Intelligence

智能的情感、社会与文化视角

Linas Juozenas
跳转至文章

智力释放 · 人类情境

Beyond IQ emotion, relationships and culture

推理能力很重要,但明智的行动还取决于察觉情绪、理解他人、学习当地规范,以及在不丧失判断力的情况下进行适应。情绪智力、社会智力和文化智力能够阐明这些能力——前提是我们不把三个不同的概念变成一个令人讨喜的分数。

更广泛不等于可以互换能力、自我认知、习得的技能与伦理行为属于不同类型的构念。
方法会改变含义表现任务、问卷和观察者评分回答的是不同问题——即使它们都被贴上“EQ”的标签。
情境是能力的一部分同一个线索或行为,在不同的关系、环境、语言、文化和神经类型中可能有不同含义。

更宽广的视角,更清晰的定义

智商并不完整;但这并不意味着每一种替代指标都是一种新的智力

认知测试在标准化条件下抽样测量推理、知识、记忆、加工能力及其他能力。对于明确的用途,它们可以提供有用信息。但它们并不直接测量一个人是否能够修复一段关系、意识到某个熟悉的手势在其他地方代表不同含义,或选择一个具有人道关怀的目标。

因此,“超越智商”是邀请我们加入相关证据,而不是否定认知能力,或把 EQ、SQ 和 CQ 组成一个普适的等级体系。真正有成效的问题始终是具体的:是哪种能力、如何测量、处于何种情境、服务于哪项决策?

01 · 明确论点方向

“超越智商”应当意味着什么

完整描述功能需要不止一类证据,但只有在各个维度的边界仍然清晰可见时,增加维度才有意义。

人的表现源于认知资源、情绪、社会协调、知识、动机、文化、健康、机会和当下要求之间的相互作用。与IQ相关的能力可能有助于学习和解决问题,但无法替代该系统中的其他所有部分。

情绪

运用情感信息

以符合目标的方式觉察、区分、理解和调节情绪。在研究中,这可能意味着经过测验的能力、自我感知的倾向,或更广泛的能力模型,而不是某种普遍认可的“EQ”。23

关系

理解他人并与他人协调

谨慎推断意图,跟随互动进程,清晰沟通,修复误解,并在人际关系中明智行事。桑代克早期提出的“社会智力”已经将理解与行动结合起来。1

文化

了解情境在这里意味着什么

认识到目标、类别、表达方式和规范都受到文化塑造;暂缓过早下定论;并通过反馈调整行为。文化智力将这一适应性工作的一部分正式化。

增加证据;不要用一种简化取代另一种简化

认知得分可以提供有用信息,但不能用来衡量一个人的价值。情绪或文化问卷可以捕捉有用的自我认知,但不能因此成为给整个人格排序的许可。拓展评估应带来更审慎的解读和更好的决策,而不是更多标签。

横向滚动以进行比较 →
四种视角,四个不同问题
视角 核心问题 通常通过以下方式进行测量 单凭此项无法确定
认知能力/IQ 相对于常模群体,一个人多有效地解决特定认知任务? 标准化的推理、知识、记忆、空间或速度任务。 品格、人生价值、同理心、文化知识,或在每种环境中都取得成功。
情绪智力 一个人如何感知、理解或管理情绪——或者他们认为自己具备怎样的能力? 能力任务、自我报告量表、知情者评价和模拟。 “EQ”是一种单一能力,或情绪技能总是被善意地使用。
社会智力 一个人理解互动并在其中应对的能力如何? 社会认知任务、情境判断、行为观察和报告。 普遍适用的社会商数,或唯一正确的沟通方式。
文化智力 一个人多有效地在文化陌生的环境中学习和适应? 最常使用自我报告式CQ量表;有时也使用观察者报告或绩效结果。 掌握每一种文化、免受偏见影响,或获得模仿刻板印象的许可。

02 · 说明论断的类型

一个标签可能掩盖多个构念

许多关于EQ或SQ的分歧,本质上是对测量对象的分歧。

“情商高”可能意味着正确解决情绪问题形容自己冷静且善解人意被同事评价为技能娴熟,或展现出一系列广泛的领导能力。这些指标可能彼此相关,但不能互换。

能力

最高表现

这个人在一项任务中能做什么,而这项任务的答案有些更有依据、有些则依据不足?例如,识别情绪可能如何组合或变化。

特质

典型自我认知

这个人通常如何看待自己的情绪相关倾向?例如:“我能用语言表达自己的感受。”

行为

观察到的表现

在明确、结构化的互动或抽样的现实情境中,这个人会做什么?

价值

规范性判断

该行为是否诚实、尊重他人或公平?不能仅凭社交效能推断其伦理品质。

横向滚动以进行比较 →
为什么测量方法会改变解读
方法 应理解为 有用优势 典型局限
表现任务 在特定规则和条件下展现的能力。 不完全依赖自我洞察;类似于对最高表现水平的测试。 对“正确”的情绪反应进行评分可能存在争议,而且任务只抽样考察狭窄的领域。
自我报告 对典型倾向的信念。 能够高效了解私人体验和自我概念。 容易受到自我认知局限、作答风格、印象管理和题目理解方式的影响。
他人评价 特定观察者能够看到的声誉或行为。 通过多次接触增加外部视角。 取决于观察机会、关系、规范和评价者偏差。
模拟/观察 在抽样情境中的行为。 能够保留情境信息,并展示一个人实际会做什么。 成本高、难以标准化,而且仍然只能覆盖部分情境。
结果代理指标 由个人与环境共同产生的表现。 将一项评估与某种重要结果联系起来。 成绩、销售业绩、幸福感或晋升反映了资源、机会、歧视以及许多其他原因。

效度属于对结果的解释和使用,而不是某个标签。在接受“高情商能够预测 X”这一说法之前,应先问清楚使用的是哪种模型、哪种测量工具、抽取了哪些样本、X 具体是什么、纳入了哪些协变量,以及研究设计是否能够支持因果主张。742

03 · 区分不同模型类别

不存在一个名为“情商”的单一科学对象

这个术语之所以流行,是因为它直观易懂。当理论家区分能力模型、特质模型和混合模型后,研究变得更加清晰。

Salovey 和 Mayer 于 1990 年发表了现代情商领域的奠基性框架,描述了评估、表达、调节和运用情绪的技能。2 后来的能力模型将情商视为处理情绪信息的心理能力。34 特质情商涉及人格中的情绪相关自我认知。5 混合模型将情绪能力与动机、人格和社会能力结合起来。7

能力型情绪智力

解决有关情绪的问题

通常通过表现任务进行评估。其核心主张是,人们在准确感知情绪信息、将其用于思考、理解情绪以及管理情绪方面存在差异。

特质情绪智力

与情绪相关的自我认知

通常通过问卷进行评估。从概念上看,它属于人格和自我效能的范畴:人们如何描述自己通常的情绪世界和行为倾向。

混合型情绪智力

广泛的能力组合

可能包括自我意识、情绪调节、动机、同理心、影响力、团队合作及其他特质。这种广度有助于发展性对话,但也使“纯粹情商”的说法难以成立。

!

戈尔曼的五部分框架并不是梅耶尔—萨洛维能力模型

戈尔曼颇具影响力的1995年通俗论述强调了自我意识、自我调节、动机、同理心和社交技能。6 这是一种广泛的混合能力框架。若把它引用得仿佛与四分支、通过表现进行评估的能力模型是同一构念,就会造成虚假的共识。

只有在明确说明模型和方法之后,“EQ”才适合作为一种简写。

诠释规则

04 · 将情绪视为信息

能力型情商的经典四个分支

该模型从识别情绪,发展到推理情绪的变化过程,并在具体情境中调节情绪。

在能力模型中,情绪并非理性的敌人。情绪是一种信息,能够引导注意力、传达需求、影响判断并组织行动。熟练运用情绪并不意味着始终保持积极或冷静;而是要以符合现实和目标的方式回应情绪信息。

  1. 感知情绪。 从面部、声音、姿势、语言、艺术以及自身的身体体验中识别并区分情感信息。准确性取决于情境:面部动作是线索,而不是透明的读数。

  2. 运用情绪促进思考。 留意情感如何能够决定注意力的优先级,或支持不同类型的思考。谨慎的心境可能适合检查错误;热情则可能有助于探索。重点在于灵活运用,而不是机械地诱导某种偏好的心境。

  3. 理解情绪。 掌握情绪词汇、情绪混合、成因、可能的转变以及条件关系——例如,未得到处理的恼怒可能如何变成愤怒,或者释然与悲伤如何能够共存。

  4. 管理情绪。 对有用的情绪保持开放,影响其强度或持续时间,并在同时考虑个人与情境的情况下选择回应方式。管理情绪并不等同于默认压抑情绪。

这四个分支是一种理论上的递进,并非每次测试或对每个人都保证呈现为阶梯式发展。当代概述保留了这一结构,同时也承认测量——尤其是对“运用情绪”分支的测量,以及基于共识的评分——仍存在争议。347

法规包括改变情境

如果工作负荷不安全、边界被越过,或某项规范具有歧视性,成熟的应对方式可能是寻求支持、质疑这种状况或离开,而不是变得更能忍受它。情绪技能不应把结构性伤害转化为个人镇定能力不足的问题。

05 · 典型体验不等于最大能力

特质型和混合型情绪智力回答的是不同问题

自我信念和广泛能力很重要,但应当按其本来面貌进行解读。

特质情绪智力描述了一组与情绪相关的自我知觉,例如对情绪调节、坚定表达、共情、适应性和幸福感的自我评价。由于这些是对典型表现的自我报告,特质情绪智力属于人格领域,而不是传统意义上的认知能力。5

自评能告诉你什么

当事人对自己的认知模型

这可能很有价值。人们对应对、表达和人际关系的信念会影响选择、坚持和寻求帮助。问卷也可以为反思提供语言;而且,与行为证据或他人提供的证据进行比较时,还能揭示值得探索的不匹配。

它无法证明什么

在每次互动中都能做到客观准确

自信程度可能超过实际技能;谦逊的人可能低估自己;受测者可能会进行印象管理;同一道题在不同群体中也可能代表不同的理想。自评结果的总分被称为商数,并不会因此变成能力表现证据。

混合模型有意拓宽了框架。在领导力或辅导中,这可能很实用:自我意识、适应性、团队合作和影响力都值得关注。然而,广泛的测评量表可能与人格、动机、自尊和偏好行为相重叠。如果它能够预测某种结果,研究者就必须追问:究竟是哪些要素在推动这种关联,以及在已有预测变量之外还剩下多少信息。9

横向滚动以进行比较 →
不要把不同情绪智力类别的分数进行比较,仿佛它们共用同一把尺子
类别 构念 常见的作答形式 合理的表述 应避免的过度声称
能力型情绪智力 处理情绪信息的能力。 根据标准对问题或判断进行评分。 “在这些情绪理解任务中表现相对出色。” “具备出色的共情能力和人际关系技巧。”
特质情绪智力 与情绪相关的自我知觉与倾向。 对自我描述陈述的认同程度。 “自述对调节情绪有信心。” “能够客观地良好调节情绪。”
混合型情绪智力 广泛的情绪与社会能力。 自评、他评或多评者能力量表。 “在这份他评表中,评分者经常报告这种领导行为。” “该结果单独反映情绪智力。”

06 · 让测量工具匹配目的

情绪智力的测量方式

一份精心制作的分数报告并不能解决构念含义模糊的问题。先明确预期推论,再选择能够支持该推论的证据。

最知名的原始能力测验是梅耶–萨洛维–卡鲁索情绪智力测验(MSCEIT)。它通过涉及面孔、图片、感觉、情绪词汇、情绪混合、情绪变化和情绪管理情境的任务,对四分支模型进行抽样测量。特质工具,如特质情绪智力问卷(TEIQue),询问人们对自身典型特征的看法。其他量表则评估广泛的混合能力。这些总分不可互换。7

横向滚动以进行比较 →
根据问题选择情绪智力方法,而不是根据对品牌的熟悉程度
如果你需要了解…… 考虑 添加 不要得出结论
这个人能否进行情绪推理? 具有充分验证且评分证据透明的表现测量工具。 认知能力、语言能力和相关情境信息。 任务表现就能保证人在压力下做出明智行为。
他们如何看待自己的通常倾向? 具有适当常模和可靠性的构念特异性自我报告。 知情者视角以及各量表之间的差异。 自信等于准确性。
工作中或团队里会发生什么? 结构化观察、情境判断或以行为为锚定的多评定者数据。 角色要求、机会、权力、团队氛围和实际结果。 每一项评分差异都源于个人内部。
学习项目是否有效? 预先规定的技能测量、行为迁移和后续跟踪,而不只是满意度问卷。 在可行的情况下设置比较条件,并检查实施质量。 更高的后测自评分数就能证明现实世界中的持久改变。

能力评分确实是一项挑战。有些任务采用专家共识或群体共识,但在每种文化和情境中,最常见的答案并不一定是适应性最强的答案。自我报告避免了这一评分问题,却引入了另一个问题:它们测量的是个人对描述性陈述的反应,并会受到自我洞察、社会期许和参照群体的影响。一项对主要工具的批判性综述建议,应根据构念、目的和心理测量学证据进行选择,而不是把情绪智力领域视为一个单一的量表体系。7

2

2025 年修订版需要接受独立测试

MSCEIT 2 将第二分支更名为“连接情绪”,并以由八名博士级专家组成的小组制定的真实性答案标准,取代了共识评分。在最初的开发者报告中,总分的内部一致性较强,但“连接情绪”分支的可靠性明显较低;作者提醒,不应过多解读该分支在个体层面的结果,并报告称,其在美国和加拿大以外的普遍适用性在很大程度上仍属未知。因此,仍需要独立且更广泛的跨文化验证。81

  • 界定构念。在选择工具前,明确测量的是能力、特质还是混合能力。
  • 检查评分方式。询问答案如何被判定为正确、如何赋权或汇总。
  • 审查证据。信度、结构、效度和公平性应与目标人群及使用场景相匹配。
  • 采用多种方法。高风险决策不应仅依赖单项自我报告或总分。
  • 保护隐私。情绪数据可能非常私密;只收集必要的信息,并说明访问权限和保留期限。
  • 提供申诉途径。人们应能够对错误提出质疑、补充背景信息,并避免被迫披露。
?

面孔是证据,不是定论

面部运动并不与内在状态一一对应。表情会随情境、文化、个人习惯和调节方式而变化。人类观察者和自动化系统都可以对可见的面部运动进行分类;但任何一方都无法仅凭一张孤立的面孔直接读出一个人的私密感受。2829

07 · 按真实大小解读关联

情商与什么相关,以及它不能证明什么

情商测量与多项受重视的结果相关,但这种关系的大小和含义取决于模型、方法和评估标准。

证据既不是“情商改变一切”,也不是“情商毫无意义”。元分析发现,情商与学业表现、工作绩效、领导力评价和广义繁荣感存在关联。891011 它们还显示出异质性、与人格和认知能力的重叠,以及当预测变量和结果变量共享测量方法或情绪内容时更强的关联。

有支持的关联

学业表现

一项2020年的元分析发现,情商与学业表现之间的总体相关约为 .20。能力型、自评型和混合型测量的表现并不完全相同,而且在智力和人格之外的增量预测力小于原始相关。8

取决于情境

工作绩效

一项整合性元分析发现,测量渠道和情绪要求可能很重要。其调节变量分析表明,能力型情商与高情绪劳动和低情绪劳动工作中的绩效存在不同关联,但作者将该结果描述为初步发现,而且各工作类别的子样本很小;宽泛的混合测量得分也与既有特质存在较大重叠。9

范围广泛但存在异质性

领导力与繁荣感

当情商和领导力由不同来源进行评价时,二者的关联会大幅减弱。10 一项2026年的二阶元分析发现,在62项元分析中,情商与繁荣感总体相关为 .28,但结果存在异质性,且当两者都采用主观自我报告时,相关性最强。11

横向滚动以进行比较 →
从研究结果到站得住脚的表述
研究发现 站得住脚的解读 诱人的过度推断
情商与成绩相关。 与情绪相关的能力或倾向可能通过调节、关系或投入来支持学习;互惠解释和第三变量解释仍然是可能的。 提高情商必然会按照观察到的相关性提高每位学习者的成绩。
管理者的情商得分与领导力评价相关。 所测量的特质可能有助于需要人际协调的岗位。 情商比专业能力、诚信或工作条件更重要。
自评情商与福祉相关。 适应性的自我认知与福祉共同变化;部分内容可能存在重叠。 问卷得分可以诊断心理健康状况,或证明情绪技能导致了健康结果。
混合型情商量表可以预测绩效。 广义的能力组合可能包含相关信息。 仅情绪成分产生了这种关联。

预测也不等于命运。适度的群体层面关联中会包含许多例外。选拔或晋升需要有证据支持这种确切用途,证明其相较于更简单测量方式的比较价值,进行公平性分析,并清楚说明后果——而不是诉诸“高情商者胜过高智商者”这一流行说法。4254 不应使用情商得分来诊断精神障碍。

!

语言往往超出了研究设计所能支持的范围

一项对73篇情商综述进行的2026年评估认为,其中59篇质量低下或不可接受,并发现几乎所有接受审查的综述都提出了超出基础证据范围的因果性或声望导向的论断。12 这一批评并不意味着每一项情商结果都是错误的;它意味着必须使用保守的措辞。

08 · 练习一个循环,而不是塑造一种人设

情绪技能可以培养吗?

荟萃分析表明,与情商相关的训练可以改善测得的情商或情绪能力得分,但项目、测量工具和研究质量各不相同。

训练证据令人鼓舞,但并非神奇。综合研究报告显示,针对性情商或情绪能力测量指标平均有所提升。1314 在2024年的职场综述中,研究结果存在高度异质性;大多数研究具有严重或极高的偏倚风险,很少使用能力测试,后续跟踪证据也很有限。未来更强的研究应教授明确的技能,采用主动练习,并测量可观察到的迁移效果;持久的日常行为和组织层面的结果需要直接证据。

  1. 留意。停下来,留出足够时间去觉察身体感受、注意力和行动冲动。如果唤醒程度很高,应先确保安全并争取时间,再尝试进行细致分析。

  2. 暂时命名。使用证据支持的最具体标签:恼怒、羞愧、如释重负、孤独、受到过度刺激。把它视为一种假设,而不是身份或确定事实。

  3. 定位信号。问问发生了什么、当前激活了哪种解释、涉及哪种需要或价值观,以及情境中的哪些部分可以改变。

  4. 根据目标进行选择。选项包括重新评估、解决问题、寻求支持、接受无法改变的事情、设定界限、延迟行动或调节表达。没有一种策略在所有情况下都最佳。1516

  5. 检查效果。回应是否提高了准确性、安全感、联结或进展?涉及他人时,请征求反馈,然后进行更新。

人际练习

反思、假设、询问

总结对方表达的内容,试探性地提出情绪推断——“听起来这让你很沮丧;我理解得对吗?”——并让对方纠正你。相比于对“未言明的感受”表现出确定无疑,进行核实更尊重他人,也更准确。

校准练习

预测、观察、更新

在一次艰难的交流前,写下你的预期、信心程度,以及哪些证据可能改变你的想法。之后将预测与实际发生的情况进行比较。改进需要错误信息,而不仅仅是重复练习。

在一项实验室范式中,与对照任务相比,为图片中的面孔选择情绪词的参与者表现出较低的杏仁核反应,以及前额叶某一区域更高的活动。17 该发现支持对情绪标记进行研究;它并未检验每天给自己的感受命名这一练习,也不能证明存在固定的临床益处。

一个有用的学习目标应当具体且可观察

“变得高情商”很模糊。“在每周的一对一交流中,先总结再回应,询问你的理解是否准确,并记录已约定的行动是否清楚”则可以练习、观察和修正。

09 · 从理解到协调

社会智力不等于讨人喜欢

这个说法具有历史重要性,也很实用,但“SQ”并不是一个普遍标准化的商数。

桑代克在1920年将社会智力描述为理解他人并在人际关系中明智行事。1 一个世纪以来的相关研究如今涵盖多个名称:社会认知、人际敏感性、心理理论、情绪识别、共情准确性、沟通技能和社会胜任力。它们彼此重叠,却不能合并为一种单一能力。

检测

采集信号

关注措辞、时机、目光、语调、姿势、互动历史和更广泛的情境。信号检测并非万无一失,孤立的非语言线索尤其含糊。

推断

构建视角模型

为他人知道什么、想要什么、感受什么或意图什么生成解释。良好的推断会保留多种可能,并区分证据与投射。

协调

行动并修复

提出请求、把握发言时机、调整信息、协商规范或修复误解,同时持续观察互动如何发生变化。

人际准确性与一般认知能力之间存在微弱的正相关,但不能还原为一般认知能力。18 社会认知研究同样描述了若干部分相互独立的过程,包括感知生物运动和面孔、推测心理状态、学习社会价值以及调节行为。1920

!

“察言观色”可能掩盖这是谁的处境

未明说的规范可能反映有益的协调,但也可能维护地位、惩罚直接沟通,或排斥不熟悉主流规则的人。社交能力包括澄清规范并对其作出判断,而不只是最快地遵从它。

10 · 分解表现

社会理解由多个部分组成

一个人可能在某个组成部分上很强,却需要在另一个组成部分上获得明确支持。

社会互动是一个不断变化的问题:多人相互观察,依据不完整的心理模型采取行动,同时改变着他们试图理解的情境。因此,成功不仅取决于察觉面部表情或了解礼仪。

横向滚动以进行比较 →
可区分社会能力的实用图谱
能力 涉及内容 示例任务 常见混杂因素
社会知觉 随着时间推移,识别相关的语言和非语言信息。 注意到会议的节奏、轮流发言方式和措辞已经发生变化。 视力、听力、语言、熟悉程度和焦虑都会影响获取线索的能力。
心理状态推理 表征另一个人可能知道、相信或打算做什么。 意识到一位同事正在依据过时的信息行事。 一项任务可能通过较低层次的线索解决,而不必清晰地分离出心理状态推理。21
共情准确性 估计另一个人不断变化的想法或感受。 记录一次互动时,追踪对话伙伴如何描述自己的感受。 相似性、自我披露程度以及对方的表达方式都会影响表面上的准确性。
社会知识 了解与特定情境相关的角色、惯例、历史和规范。 了解谁作决定、谁会受到影响,以及通常如何提出异议。 知识可能是情境性的,而不是一种可迁移的个人特质。
沟通 表达、倾听、核实和修复。 表达自己的需要,不暗示自己能读懂对方的想法,然后确认双方是否理解一致。 人们会根据受文化和权力影响的预期来评判风格。
自我调节 保持足够的注意力和灵活性,以便有意识地作出回应。 受到批评后先暂停一下,在辩解之前询问一个具体例子。 疲劳、威胁、超负荷和不安全的环境都会限制表现。
推断错误

投射

“如果我会觉得被冒犯,那他们肯定也会觉得被冒犯。”具备社交智慧的推断,会把自己的反应作为一种可能性,然后寻找针对对方的证据。

纠正

认识论上的谦逊

“我可能遗漏了什么。那对你来说意味着什么?”主动询问并不表示直觉失败;这是实现准确且相互理解的一部分。

11 · 用四个问题替代一个温暖的词

共情、准确性和关怀并不相同

“共情”可以指理解、感同身受或关切。每一种含义都有不同的作用,也有不同的失效方式。

即使不认同对方的感受,也可以理解另一个人的视角;即使不了解痛苦的原因,也可以察觉到对方的困扰;即使误解了对方的需要,也可以深切地在乎对方。将这些可能性区分开来,有助于改进研究。2223

认知共情

表征一种视角

理解他人可能持有的信念、意图或感受,而不假定对方的心理运作方式与你相同。

情感共鸣

分享或回应情感

体验对他人状态的情感反应。共鸣可能促使人建立联结,也可能变得难以承受。

共情准确性

匹配目标

随着时间推移,较为准确地推断他人所报告的想法或感受。自信程度和准确性可能并不一致。

关切/同情

关心福祉

感到有动力去帮助他人或避免造成伤害。关怀仍然需要同意、判断力,以及关于什么才真正有帮助的知识。

共情本身不是道德指南针。它可能具有选择性,偏向生动或熟悉的对象,也可能被用来预判他人的脆弱之处。公平的决策还需要原则、对缺席者的换位思考、调节能力,以及对后果的关注。24

从猜测转向协作式准确理解

观察当下可获得的信息。将解释作为暂时性的判断提出。邀请对方纠正。询问对方希望得到什么支持。尊重对方拒绝透露信息的选择。即使对方也不确定自己的体验,他们仍然是自身体验的首要权威。

12 · 不再采用单一回路的叙事

社会脑是一个网络,而不是一个共情开关

不同的社会任务会招募相互重叠的系统,用于知觉、记忆、奖赏、行动、心理状态推理和控制。

社会神经科学表明,社会认知涉及分布式且依赖情境的网络,包括内侧前额叶皮层、颞顶联合区、上颞沟、杏仁核、脑岛和扣带皮层等区域。某一区域的激活并不等于某个心理标签:同一结构可能参与多种过程,而其活动模式取决于任务和比较条件。192022

横向滚动以进行比较 →
镜像神经元:发现、推论与过度解读
层级 证据支持的内容 不能自动推导出的结论
最初的观察 猕猴运动前皮层中的单个神经元会在动物进行某些目标导向的动作时放电,也会在动物观察相关动作时放电。25 认为这些细胞被发现为一种完整的人类共情机制。
人类证据 脑成像、刺激研究和有限的单细胞研究支持:人脑部分区域具有行动—观察匹配特性。26 认为每一种被称为“镜像”的激活都具有相同功能,或认为脑成像能够识别单个镜像神经元。
功能解释 运动匹配可能与其他系统相互作用,共同促进行动知觉、预测、模仿或互动中的学习。26 认为模仿对于理解意图、感受共情、习得语言或创造文化而言是必要的或充分的。
训练主张 经验可以塑造知觉—行动联结;可以针对特定结果研究具体的社会或运动实践。 已有研究表明,表演、舞蹈或微表情训练能够“磨炼镜像神经回路”,从而提高社会智能。

批判性综述指出,关于镜像神经元如何理解动作的强理论存在重大缺口。27 谨慎的结论并不是说镜像神经元无关紧要,而是说,一个引人入胜的运动特性本身无法承担解释共情、社会学习和文化的全部重任。

神经相关性不是完整的机制,机制也不是训练处方。

证据阶梯

13 · 将有效性置于伦理约束之下

关系技能可以建立联系、协调行动,也可以进行控制

具有说服力、能够准确感知情绪或了解人际网络,并不能告诉我们这种行为服务于谁的利益。

社会智能往往体现在日常维护中:信守承诺、分享信息、认可他人的贡献、明确说明期望,以及修复关系破裂。这些行为会建立可靠的协作。但同样的动机、时机和情绪知识,也可以被用于印象管理、排斥或操纵。

相互的

澄清并协调

披露相关目标,邀请他人提出异议,倾听影响,协商边界,并让对方能够自主选择。

模糊的

缺乏足够透明度的影响

利用情绪化的表述或非正式网络,却不说明相关利益、替代方案或权力差异。

剥削性的

针对脆弱性

诱发恐惧、义务感、羞耻或虚假的亲密感,以获得知情且不受压力的选择不会产生的服从。

在一项行为实验室研究和一项职场研究中,更高的情绪调节知识强化了道德认同较高者的亲社会行为,也强化了马基雅维利主义较高者的人际偏差行为。30 由于对知识的测量并非随机分配,因此这并不能证明知识导致了其中任何一种模式。领导力评估不应将亲和力、魅力或影响力视为正直的替代指标。伦理保障应纳入设计:透明度、同意、分散的发言权、可问责的目标,以及提出质疑的渠道。

  • 说明目标。正在追求什么结果?由谁选择了这个结果?
  • 梳理利益相关者。谁从中受益、承担风险,或没有出现在讨论现场?
  • 检查权力。对方能否在不受惩罚的情况下表示不同意或离开?
  • 检验方法。如果这种影响被明确说明,它是否仍会让人感到可以接受?
  • 邀请纠正。是否有安全的途径报告影响并弥补伤害?
  • 追踪结果。信任和参与度是否有所提升,包括地位较低的成员?

14 · 让互惠真正成为双向的

自闭症、神经多样性与相互理解

沟通困难可能源于不同的沟通方式和期待之间的错位,而不只是源于某个人身上的缺陷。

双重共情问题认为,当拥有不同经历和理解世界方式的人相遇时,相互理解可能会中断。31这里讨论的证据针对自闭症,不应推广到所有神经多样性群体。该观点并不声称每次社交困难都是对称的,也不声称个体支持从来没有用。它反对把某一群体的沟通方式视为衡量其他所有人的中性标准这一假设。

不匹配的证据

评判是相互的

非自闭症成年人仅根据简短的视听样本,就对自闭症成年人形成了更快且更不利的印象;当评定者收到不含视听线索的文字记录时,这些群体差异消失了。32 观察者的期待是互动的一部分。

早期的匹配研究

有希望,但并非普遍适用

研究发现,仅由自闭症者组成的链条能够有效传递信息,并且相比混合神经类型的互动,相同神经类型的互动中报告的融洽感更高。3334 它们的样本和任务限制了可推广性。

更新的测试

整体模式更加复杂

一项规模更大且预注册的研究未能复现混合神经类型的信息传递劣势;仅由自闭症者组成的链条与仅由非自闭症者组成的链条表现相近,而披露诊断信息提高了融洽感。35

近期研究进一步提醒我们保持谨慎。一项2026年的研究发现,按评定者或目标对象的神经类型划分,自闭症者与非自闭症者在共情准确性方面总体没有差异;其连续效价测量仅显示出非常小、处于趋势水平的交互作用,而其具体情绪测量则未显示显著交互作用。36 一项2025年的荟萃分析发现,认知共情的平均差异更大,但情感共情的差异很小;在高质量研究子集中,这一差异并不显著。37 测量方式、样本和支持需求都很重要。

更公平的实践目标是相互理解。明确表达期望;允许直接和间接的沟通方式;提供议程和处理时间;不要把眼神交流、闲聊、面部表情或快速回应视为兴趣和共情的普遍证据;并询问每个人什么有助于沟通。双重共情是一种关系性、概率性且关注权力的修正视角——它并不证明每次误解都是对称的,也不证明每次相同神经类型的互动都更容易。

不要只训练权力较弱的一方进行伪装

不要假设持续压抑自然的动作、沟通或感官需求不会带来代价。共同的工作也应改变环境、教育互动伙伴,并消除可以避免的模糊之处。提供适应措施也是一种社会智能干预。

15 · 追问能力的用途

文化塑造“聪明”的含义

文化中并不存在一个统一的心智。文化会组织机会、工具、价值观和期望,使某些表现得到更多练习,也更容易被看见。

心理学常常根据来自西方、受过教育、工业化、富裕和民主社会的参与者进行概括。一项重要综述表明,这些人群在从知觉、空间推理到合作和自我概念等多个领域都可能具有不同寻常的特征。38 修正方法不是罗列各大洲的刻板印象,而是改进抽样、开展本地合作,并明确概括推广的界限。

横向滚动以进行比较 →
文化影响智力主张的五个方面
层面 问题 示例
价值 哪些结果会被视为聪明? 快速独立解决问题、负责任的社会判断、熟练参与或守护管理,可能会被赋予不同的权重。
机会 一个人有什么理由去学习哪些工具和解决哪些问题? 学校教授的抽象知识与当地重要的生态知识,反映了不同的实践历史。
表达 能力应如何展现? 先发言、停顿、征询长者意见或表现谦逊,可能会得到不同的解读。
任务 除了目标能力之外,评估还要求什么? 语言、符号、技术、速度、考官角色和应试惯例都会影响表现。
解读 应采用哪种比较,又会产生什么后果? 分数可能会根据不合适的常模解读,或被用于一个从未经过验证、不适合支持的决策。

对赞比亚农村奇切瓦社群开展的长期研究发现,当地对nzelu的理解将认知敏捷性与社会责任结合在一起。39在肯尼亚西部农村开展的一项研究中,儿童对当地使用的草药所具备的默会知识,与基于学校的能力测量呈现出不同的关联;作者据此认为,实践知识与学术知识可能通过不同的经验和激励机制发展。40

这两个例子都没有定义“非洲智力”,也没有把所有在当地被重视的知识都视为可靠或科学正确。它们揭示的是一个更狭窄却更重要的问题:研究者如果一开始只采用外来的分类,就可能忽视受到重视的能力。主位研究从某一情境内部的意义和实践出发;客位研究则寻求能够跨情境比较的构念。强加的客位把某一情境的分类输出为普遍分类;派生的客位则在本地叙述与比较性检验之间反复迭代,以确定一个有充分依据的共同核心。严谨的跨文化研究会用其中一种来检验和修正另一种。41

!

国家与文化并非同义词

人们参与多种不断变化的文化,这些文化受到语言、地区、职业、阶层、宗教、世代、残障、家庭和组织的影响。群体内部的差异不是应被抹去的噪声。文化倾向应始终只是概率性假设,绝不能成为针对个人的行为脚本。

16 · 检验解释,而不是口号

文化与公平评估

公平性不是永久附着于测试之上的标签。它涉及针对某一人群、语言、施测方式和后果所作出的特定解释与使用。

文化负载并不等同于测试偏差。每项评估都依赖于习得的语言、符号、作答惯例、技术、考官角色或受重视的策略。其中一部分负载与预期构念相关;语言测试应当依赖语言知识。当与构念无关的要求系统性地扭曲分数解释时,就会产生偏差。仅凭群体均值差异,既不能证明也不能否定这一问题。424546

!

不存在完全脱离文化的测试

非言语题目可以减少特定的语言要求。但它们仍依赖于说明、视觉惯例、对测试的熟悉程度、速度规则、受教育经历以及对互动的假设。应优先使用“在这些条件下语言要求较低”等精确描述,而不是不加限定地使用“文化公平”标签。

横向滚动以进行比较 →
公平性需要多种类型的证据
问题 需要考察的证据 阳性结果仍无法确定的事项
该构念是否有意义? 本地咨询、内容审查、反应过程以及对相关行为的覆盖。 该分数的功能具有可比性,或支持所提出的后果。
测量效果是否具有可比性? 相关群体之间的因素结构、信度、测量等值性和差异项功能。 该构念具有文化价值、预测结果相同,或决策是公正的。
预测效果是否具有可比性? 按群体进行校准,包括斜率、截距、残差和错误率,最好使用样本外数据。 该标准是公平的、原因得到理解,或每个错误的代价相同。
人们能访问它吗? 语言、读写能力、感官、运动、时间、技术、环境和施测人员方面的要求。 认为完全相同的施测方式就是公平的,或认为每项调整都能保留原有构念。
后果是否可以接受? 选拔和分类比例、假阳性和假阴性、服务获取、申诉以及后续结果。 社会应当接受哪些权衡;这同样是一个伦理和政策判断。

适配测验,而不只是翻译其中的文字

良好的测验适配应先界定构念和比较目标;让双语领域专家以及了解目标环境的人参与其中;检查概念等值性和语言等值性;开展认知访谈;在预期条件下进行试测;并重新审视结构、题目、常模、效标、实施方式和可及性。正向翻译和回译可以发现错误,但仅凭二者无法确立意义或分数的等值性。4344

把不变性和 DIF 当作工具,而不是终点

构型不变性考察广义的因子模式是否合理;量度不变性约束因子载荷,并支持对关联进行有限度的比较;标量不变性还进一步约束截距或阈值,通常应在比较潜在均值之前达到。差异项功能会标示出:在控制预期特质后,某些题目在不同群体中的表现不同。出现标示需要进行实质性审查:它并不自动证明存在偏差,而不显著的检验结果也可能反映统计功效不足或建模不当。4748

即使不变性结果很强,也无法证明某个构念有意义,或某种使用方式是公平的。2025 年的一项演示表明,传统的不变性检验可能在一组刻意设计得毫无意义的题目上通过——这是一个精妙的警示,提醒我们不要把技术性检查点当作构念验证。49

常模与预测

问一问:“与谁相比,为了什么?”

常模应符合参考问题所需的年龄、语言、教育程度、施测方式、地点和日期。地方常模可以减少因比较对象不合适而导致的错误分类,但不能纠正构念偏差,也不能证明机会均等。预测偏差是一个独立的实证问题,需要进行校准和误差分析,不能仅凭亚组相关性得出结论。505152

可及性与调整措施

公平可能要求采用不完全相同的条件

调整措施旨在消除与目标构念无关的障碍。如果某项改变影响了分数所测量的内容,原有常模可能不再适用。应记录理由,检验与辅助技术的兼容性,并监测结果,而不是想当然地认为必须采用完全相同的处理方式,或任何修改都天然公平。4253

最终的效度论证必须将证据与拟议的解释和使用联系起来,明确论据依据和假设,寻求反面证据并考虑替代方案。54 当EQ、社会或文化测量进入招聘、教育或照护领域时,这一点尤其重要:宽泛的构念、透明的自我呈现和对情境敏感的行为,可能使单一分数线格外难以辩护。

动态评估:有用的补充,而非纯粹潜能

动态评估会在规定的教学、反馈或提示方案下观察表现及其变化。它能够揭示一次性静态分数可能遗漏的反应能力。综述表明,动态学习测量有时会增加预测信息,包括在阅读方面,但结果不一,而且针对文化和语言多样化学习者的证据仍然有限。555657

教学语言、考官行为、提示规则、动机、练习效应和实施忠实度仍会影响结果。动态评估无法揭示脱离文化影响的、先天的或“真正的”潜能。它能够合理支持的结论更为有限:关于受测者在实际采用的评估方案下学习情况的证据。

17 · 在不本质化的情况下适应

文化智力的四种能力

CQ关注的是在文化多样化环境中有效发挥作用。其主流组织模型包含四个因素,而不是三个。

Earley于2002年提出了现代CQ构念,随后Earley和Ang将其发展为一种适应陌生文化情境的能力。5859 后来的四因素模型区分了元认知、认知、动机和行为CQ60

元认知CQ

构建框架、监测、修订

为一次交流做计划,留意哪些文化假设正在引导注意力,在互动过程中核对解读,并在证据不一致时更新这些解读。

认知CQ

了解系统与可能性

建立关于制度、实践、历史、语言、价值观和惯例的暂时性知识。知识用于提出假设;它并不规定如何看待某个个体。

动机CQ

直接并持续投入努力

以兴趣、信心和坚持投入跨文化学习,包括在熟悉的线索不再奏效时仍愿意保持参与。

行为CQ

运用灵活的行为 repertoire

在适当情况下调整语言、非语言和言语行为。灵活性并不等于模仿、 caricature或必须服从某个主导群体。

CQ不是智商式商数

广泛使用的文化智力量表是一份包含20个项目的自陈量表,采用同意度作答:4个元认知项目、6个认知项目、5个动机项目和5个行为项目。其分数描述的是受测者在该工具上的典型自我感知;这些分数不是均值为100、标准差为15的能力分数,也不能证明受测者已掌握某种文化。60

扩展版工具将四个因素划分为更窄的组成部分,而综述也介绍了其他CQ模型。6171 这是普通的构念发展,并不是把所有量表视为等同的理由。总分可能掩盖一个有动机但信息不足、知识丰富但僵化,或行为灵活但缺乏反思的人。

证据支持的内容

在以相关研究为主的证据中,测得的CQ越高,通常与跨文化判断、社会文化适应以及一些由观察者评定的绩效结果相关。一项涵盖199个独立样本的大型荟萃分析发现,一般CQ因素和特定因素的信息都能发挥作用;模型中的CQ变量在纳入的控制变量之外增加了预测力,但估计值因结果而异,且同一来源的关系往往更强。62

并非每项研究都发现了清晰的区分或增量价值。一项多研究调查发现,在某个样本中,自我报告的CQ与自我报告的EI高度重叠,并且在该样本中无法额外预测适应。63 合理的结论是,常见的CQ量表测量的是自我报告的典型表现型CQ,而不是已被证明的最大跨文化技能。

横向滚动以进行比较 →
如何解读CQ的主要发现
证据 有证据支持的解释 边界
工作结果荟萃分析 在纳入的70项研究中,CQ及其各维度与多项工作结果相关。 观察性研究占主导地位;情境、维度和评分来源都会改变这种关联。64
适应性荟萃分析 在77项研究和18,399名参与者中,CQ各维度均与跨文化适应呈正相关;动机性CQ表现出最强的平均关系。 相关性并不能证明提高量表得分会导致适应。65
语言与CQ荟萃分析 在355个实地样本中,语言熟练度和CQ都与绩效及文化适应有关。 它们是互补的预测因素。该结果并未表明语言学习本身会提升CQ。66

CQ具有领域特异性:它不等同于文化身份、语言熟练度、一般社交技能、开放性、专业知识或美德。在特定角色中,它可以补充这些资源,但不会取代认知能力。“有效”也不一定公平。成功适应不道德的规范,仍然可能是不道德的。

18 · 将接触转化为学习

在不收集刻板印象的情况下培养CQ

旅行、语言课程或多元化团队能够创造机会,但不能保证反思、准确反馈或行为迁移。

一项对37个独立培训样本的荟萃分析发现,培训对适应有中等程度的正向影响,但对CQ和工作绩效的正向影响较小;研究方法和结果来源会产生影响。67 一种审慎且以证据为依据的设计采用反复学习循环,而不是把国家平均值转化为人格预测的简报。

  1. 界定互动情境。哪些人、角色、环境、历史、语言和权力关系很重要?“国际化”或“多元化”过于宽泛,无法指导行为。

  2. 准备两类知识。学习跨文化通用的过程——分类、归因、身份认同和权力——以及与当地相关的实践。为每一条概括标明其来源、样本和不确定性。

  3. 记录预测。在互动之前,记录你的预期及其原因。至少加入一种替代性解释,以及一个会促使你修正判断的可观察线索。

  4. 互动并探询。进行现场或逼真的模拟练习。询问对方的偏好,而不是照搬话术。留意是谁在进行适应,以及当下环境是否允许坦诚反馈。

  5. 基于证据进行复盘。将预测与人们实际说了什么、做了什么进行比较。向了解相关文化的伙伴寻求反馈,但不要要求某一个人代表整个群体。

  6. 反复演练并迁移应用。练习不止一种回应方式,选择与角色相关的行为,间隔一段时间后重新审视,并追踪其对清晰度、信任、发言空间、准确性和福祉的影响。

鼓舞人心的证据

结构化且持续的接触可能有所帮助

一项针对1,221名参与文化多样性虚拟团队的研究生的纵向项目报告称,参与者自我报告的CQ和全球身份认同有所提升;一个规模较小的后续子样本在六个月后仍保持了这些提升,团队信任度也与发展相关。该研究设计较为扎实,但并非严格的随机试验。68

反弹证据

文化教学可能固化分类

在一项针对49名配对受访者的非对照课前/课后研究中,本质主义信念有所增强,而自我报告的认知CQ和元认知CQ有所下降。该研究设计无法确定是哪一项课程内容导致了这些变化;自我评分降低,也可能部分反映了参与者更加意识到自己的未知之处。69

加入文化谦逊

文化谦逊最初被引入医学教育,强调终身自我评估与自我批判、纠正权力失衡、建立互惠互利的伙伴关系,并要求机构承担问责责任。70 CQ会问:“我能否有效解读并适应?”谦逊则进一步追问:“我的视角有哪些局限?我如何向此人学习?权力应如何共享?”

评估相互适应,而不是主导群体的认可

成功应包括准确性、信任、参与、公平与福祉。如果只有移民、少数族裔员工或地位较低的合作伙伴必须改变,那么较高的“适应”评分可能掩盖情绪劳动和同化压力。个人文化智商(CQ)无法取代语言支持、角色清晰度或反歧视制度。

相关领域的综述仍在指出一些尚未解决的问题,包括普遍性成分与文化特异性成分之分、客观绩效衡量、可塑性、边界条件以及负面用途。71 研究还表明,与CQ相关的能力既可能伴随客户关系绩效,也可能伴随机会主义行为,而道德相对主义会调节这些关系。72 能力需要一个指南针。

19 · 改变个人,也改变环境

系统既可以培养技能,也可以让使用技能付出高昂代价

情绪、社会与文化层面的运作,从来都不是个人单独产生的。

学习者无法通过自我调节消除长期威胁。员工在异议会受到惩罚时,无法开放地倾听。多语患者在无法获得语言支持时,也无法展现其理解能力。因此,对“技能不足”这一问题,负责任的回应并不总是增加辅导;有时更需要的是更清晰的流程、更安全的关系、合理便利,或重新分配权力。

学校

教授、练习并融入日常

关于普及性学校社会与情感学习的荟萃分析显示,技能、态度、行为以及学业或学校成果平均都有所改善。效果会因内容、情境和实施方式而异;项目标签并不能保证成效。737475

工作场所

让坦诚变得可行

心理安全感指一种共同信念:人际风险——提出问题、承认不确定性、报告问题——可以在不遭受羞辱或惩罚的情况下承担。它与团队学习和绩效有关,但并不等同于舒适、低标准,也不能替代问责。7778

公共系统

消除获取障碍

稳定的关系、早期支持、安全的环境、连通性、交通、残障人士无障碍服务,以及在文化和语言上适切的服务,都会扩大能力得以发展并显现的机会。

经济合作与发展组织(OECD)于2023年开展、并于2024年发布结果的社会与情感技能调查,评估了参与地区10岁和15岁儿童的情况,发现自报技能与学业成功、福祉和健康行为等结果之间存在关联,同时也存在年龄、性别和社会经济背景方面的差异。76 这些是有用的描述性模式,并不能证明某种特质导致了某项结果,也不能证明国家排名揭示了群体固有差异。

横向滚动以进行比较 →
从特质宣传转向支持架构
设计问题 个人支持 关系或系统支持 进展证据
人们能否识别并表达需求? 情绪词汇、反思与请求练习。 可预测的定期沟通、保密规则与回应渠道。 更早提出需求,并在不遭受报复的情况下解决。
分歧能否改善决策? 压力下的倾听、探询与调节。 领导者邀请不同意见,记录替代方案,并保护提出质疑者。 更多问题浮现出来;错误得到纠正;参与不再那么受地位影响。
文化背景不同的合作伙伴能否作出贡献? 检验假设、掌握相关知识以及保持行为灵活性。 语言支持、明确的规范、共同制定议程以及相互调整。 各群体的理解、发声机会和结果都会改善,而不只是让主导群体感到满意。
残障人士和神经多样性人士能否参与? 在需要时采用偏好的沟通策略并进行自我倡导。 无障碍格式、感官设计、处理时间,以及不依赖表演性社交线索的替代方式。 无需要求有害的伪装,也能改善获取机会、留任、安全和贡献。

将测量用于学习,而不是人格监控

对社会和情绪特质的自我报告容易受到题目理解、参照群体、社会期许和激励机制的影响。分数可能发生变化,是因为人改变了,是因为他们的标准改变了,也可能是因为他们学会了什么样的回答会得到奖励。79 对于项目评估,应将定义明确的测量与观察、相关结果、实施证据和参与者的陈述结合起来。对于个人决策,只使用针对该目的经过验证的证据,并提供解释和申诉途径。

人工智能

情绪识别不是自动读心

模型可以将面部、声音或动作模式映射为从其数据中学到的标签。这并不等于直接获取某人的私人状态,而且情境或群体差异可能改变这种映射。29 截至本次审查,《欧盟人工智能法》禁止在工作场所和教育机构中使用根据生物特征数据推断情绪的人工智能系统,但特定的医疗或安全原因除外。80 其他定义和规则因司法管辖区而异;即使使用合法,科学、隐私和权力方面的担忧仍然存在。

适用于实际决策的整合规则

  1. 定义任务。哪些结果重要、考察多长时间,以及对谁重要?

  2. 选择最狭义且相关的构念。如果真正的问题是对方是否理解指示或能否修复冲突,就不要问“他们的情商是多少?”

  3. 进行多方法交叉验证。在相关情况下,结合能力或知识、通常的自我看法、观察到的行为、情境和结果。

  4. 检验替代解释。语言、健康状况、机会、角色明确性、权力、不平等对待或无法无障碍使用的环境,是否能够解释这一模式?

  5. 采取相称的行动。优先选择可逆且具有支持性的决策;只有证据达到更高的证明要求时,才进行会带来重大后果的分类。

  6. 审查影响。监测谁从中受益、谁被排除、错误率,以及与更简单的选项相比,该措施是否改善了决策。

对智力最宽泛的理解,并不是包含最多分数的那一种,而是能同时看见个人、任务、关系和系统的那一种。

整合性原则

20 · 快速回答,谨慎界定

常见问题

最简要地概括最重要的区别。

EQ比IQ更重要吗?

不存在脱离语境的换算率。认知能力与许多学习和工作任务高度相关;与情绪相关的能力和倾向也能为某些结果提供额外信息。它们的相对价值取决于评价标准、角色、测量方法和其他预测变量。这里所审查的证据并不支持“EQ普遍更重要”的说法。89

EQ、SQ和CQ是真正的商数吗?

通常不能按智商的意义来理解。“EQ”可能指能力、特质或混合分数;“SQ”没有单一的标准化构念或量表;而常见的CQ测量是一份包含20个条目的同意度问卷。一个数字只有结合其模型、条目、计分方式、参照群体和证据才具有可解释性。

情商可以通过学习获得吗?

一些情绪知识、技能和自我认知似乎可以训练获得,荟萃分析显示其测量结果平均有所改善。项目质量、结果测量方法和研究质量各不相同,而持久的行为迁移和组织影响则不太确定。应明确界定技能,通过反馈进行练习,并测量迁移效果,而不是承诺某种总体情商会永久提升。1314

共情等同于社会智力吗?

不能。共情本身可能指视角理解、情感共鸣、准确性或关切。2223 社会智力的范围更广,可能涉及社会知觉、知识、沟通、协调和调节。两个术语都不能保证会采取合乎伦理的行动。2430

镜像神经元能解释共情吗?

不能仅凭这些得出结论。镜像神经元最初是在猕猴进行动作及动作观察时记录到的。相关的人类系统可能参与知觉—动作过程,但共情和对心理状态的理解会调动更广泛的神经网络。现有证据并不能证明存在一个单一的镜像神经元回路作为共情的来源。252627

非言语测试不受文化影响吗?

不会。它可能减少对特定语言的要求,而这可能很有价值。但指导语、符号、视觉惯例、时间安排、受教育经历、对测试的熟悉程度、与考官的互动以及规范仍然很重要。公平的解读需要有证据支持其针对的群体和用途。4245

文化智商会助长刻板印象吗?

如果把文化知识变成套用在个人身上的脚本,就可能如此。恰当使用时,元认知文化智商(CQ)恰恰相反:它会让假设显性化,将其与实际接触进行核对并加以修正。培训应涵盖群体内部差异、历史、权力、反馈和文化谦逊;一些设计不当的文化教学反而加剧了本质主义。6970

雇主应该使用 EQ 或 CQ 测试进行招聘吗?

只有当工作分析确认该构念具有相关性,且本地证据支持在该选拔用途中的得分解释、增量价值、可靠性、可及性和公平性时,才可以。单一的自我报告不应成为独立的筛选门槛。使用多种与工作相关的方法,监测不利后果,并提供对错误提出异议的途径。4254

AI 能检测某人的真实感受吗?

AI 可以根据模型中内置的标签和假设对数据中的模式进行分类。面部行为可能携带依赖情境的信息,但它并不能唯一反映个人的内在情绪。不要将自动化推断视为事实真相——尤其是在教育、工作、医疗、警务或其他人们无法自由拒绝的场景中。29

结合这些观点的最简单方法是什么?

从任务开始。询问任务需要哪些认知资源、哪些情绪信息至关重要、哪些人必须协调、哪些文化知识或适应具有相关性,以及哪些障碍或权力关系会影响表现。只测量决策所需的内容,使用不止一个证据来源,并将伦理判断与技能得分分开。

主要研究、证据综合与专业指导

来源与延伸阅读

链接行为:外部来源链接会在新标签页中打开。

  1. Thorndike, E. L.(1920),智力及其用途,《哈珀杂志》,140,227–235。
  2. Salovey, P. 和 Mayer, J. D.(1990),情绪智力,《想象、认知与人格》,9(3),185–211。
  3. Mayer, J. D., Salovey, P. 和 Caruso, D. R.(2004),情绪智力:理论、研究发现与启示,《心理学探究》,15(3),197–215。
  4. Mayer, J. D., Caruso, D. R. 和 Salovey, P.(2016),情绪智力的能力模型:原则与更新,《情绪评论》,8(4),290–300。
  5. Petrides, K. V., Pita, R. 和 Kokkinaki, F.(2007),特质情绪智力在人格因素空间中的位置,《英国心理学杂志》,98(2),273–289。
  6. Goleman, D.(1995),情商,Bantam Books。
  7. O’Connor, P. J.、Hill, A.、Kaya, M. 和 Martin, B.(2019),情商的测量:文献批判性综述及对研究人员和实践者的建议,《心理学前沿》,10,1116。
  8. MacCann, C. 等(2020),情商预测学业表现:一项荟萃分析,《心理学公报》,146(2),150–186。
  9. Joseph, D. L. 和 Newman, D. A.(2010),情商:整合性荟萃分析与级联模型,《应用心理学杂志》,95(1),54–78。
  10. Harms, P. D. 和 Credé, M.(2010),情商与变革型及交易型领导:一项荟萃分析,《领导力与组织研究杂志》,17(1),5–17。
  11. Robinson, T. J. 和 Zell, E.(2026),情商与人类 flourishing 的稳健关联:二阶荟萃分析,《美国国家科学院院刊》,123(19),e2532963123。
  12. Davis, S. K. 和 Mahoney, B.(2026),情商研究的元综合:系统综述与荟萃分析中的方法严谨性与语言炒作,《质量与数量》,在线提前发表。
  13. Mattingly, V. 和 Kraiger, K.(2019),情商可以通过培训提升吗?一项荟萃分析研究,《人力资源管理评论》,29(2),140–155。
  14. Mehler, M. 等(2024),职场情绪能力培训:系统综述与荟萃分析,《BMC心理学》,12,718。
  15. Gross, J. J.(2015),情绪调节的扩展过程模型:详述、应用与未来方向,《心理学探究》,26(1),130–137。
  16. Webb, T. L.、Miles, E. & Sheeran, P.(2012),应对情绪:源自情绪调节过程模型的策略有效性的元分析心理学公报,138(4),775–808。
  17. Lieberman, M. D. 等(2007),将感受化为语言:情感标记会扰乱杏仁核对情感刺激的活动心理科学,18(5),421–428。
  18. Murphy, N. A. & Hall, J. A.(2011),智力与人际敏感性:一项元分析智力,39(1),54–63。
  19. Frith, C. D. & Frith, U.(2007),人类的社会认知当代生物学,17(16),R724–R732。
  20. Schurz, M. 等(2021),迈向社会认知的层级模型:同理心与心理理论的神经影像学元分析及综合综述心理学公报,147(3),293–327。
  21. Quesque, F. & Rossetti, Y.(2020),心理理论任务究竟测量什么?理论与实践心理科学展望,15(2),384–396。
  22. Zaki, J. & Ochsner, K. N.(2012),同理心的神经科学:进展、误区与前景自然·神经科学,15(5),675–680。
  23. Cuff, B. M. P.、Brown, S. J.、Taylor, L. & Howat, D. J.(2016),同理心:概念综述情绪评论,8(2),144–153。
  24. Decety, J. & Cowell, J. M.(2014),道德与同理心之间的复杂关系认知科学趋势,18(7),337–339。
  25. di Pellegrino, G.、Fadiga, L.、Fogassi, L.、Gallese, V. & Rizzolatti, G.(1992),理解运动事件:一项神经生理学研究实验脑研究,91,176–180。
  26. Kilner, J. M. & Lemon, R. N.(2013),我们目前对镜像神经元的了解当代生物学,23(23),R1057–R1062。
  27. Hickok, G.(2009),关于镜像神经元理论解释猴类与人类动作理解的八个问题Journal of Cognitive Neuroscience,21(7),1229–1243。
  28. Elfenbein, H. A. & Ambady, N.(2002),情绪识别的普遍性与文化特异性:一项元分析Psychological Bulletin,128(2),203–235。
  29. Barrett, L. F. 等(2019),重新审视情绪表达:从人类面部动作推断情绪所面临的挑战Psychological Science in the Public Interest,20(1),1–68。
  30. Côté, S., DeCelles, K. A., McCarthy, J. M., Van Kleef, G. A. & Hideg, I.(2011),情商的杰基尔与海德:情绪调节知识既能促进亲社会行为,也能促成违反人际规范的行为Psychological Science,22(8),1073–1080。
  31. Milton, D. E. M.(2012),论自闭症的本体论地位:“双重共情问题”Disability & Society,27(6),883–887。
  32. Sasson, N. J. 等(2017),基于短暂片段判断,神经典型同伴不太愿意与自闭症人士互动Scientific Reports,7,40700。
  33. Crompton, C. J., Ropar, D., Evans-Williams, C. V., Flynn, E. G. & Fletcher-Watson, S.(2020),自闭症同伴之间的信息传递非常有效Autism,24(7),1704–1712。
  34. Crompton, C. J. 等(2020),神经类型匹配会影响人际融洽感的自评与观察者评价,而自闭症本身并不会Frontiers in Psychology,11,586171。
  35. Crompton, C. J. 等(2025),自闭症人士与非自闭症人士之间以及各自群体内部的信息传递Nature Human Behaviour,9,1488–1500。
  36. Rum, Y. 等(2026),自闭症人士与非自闭症人士之间双重共情的细微差异Molecular Autism,17(1),34。
  37. Cusson, N. M., Meilleur, A. J., Bernhardt, B. C., Soulières, I. & Mottron, L. (2025), 自闭症患者共情的系统综述与荟萃分析:测量工具的影响《临床心理学评论》,120,102623。
  38. Henrich, J., Heine, S. J. & Norenzayan, A. (2010), 世界上最奇特的人?《行为与脑科学》,33(2–3),61–83。
  39. Serpell, R. (2011), 社会责任作为智力的一个维度和教育目标:来自非洲社会项目性研究的启示《儿童与青少年发展新方向》,2011(133),23–39。
  40. Sternberg, R. J. et al. (2001), 学术智力与实践智力之间的关系:肯尼亚的一项案例研究《智力》,29(5),401–418。
  41. Berry, J. W. (1989), 强加的伦理观——本土伦理观——衍生的伦理观:一个重要理念的操作化《国际心理学杂志》,24(6),721–735。
  42. American Educational Research Association, American Psychological Association & National Council on Measurement in Education (2014), 《教育与心理测验标准》
  43. International Test Commission (2018), 国际测验委员会测验翻译与改编指南(第二版)《国际测验学杂志》,18(2),101–134。
  44. International Test Commission (2019), 国际测验委员会关于对语言和文化多样化人群进行大规模评估的指南《国际测验学杂志》,19(4),301–336。
  45. van de Vijver, F. J. R. & Tanzer, N. K. (2004), 跨文化评估中的偏差与等值性:概述《欧洲应用心理学评论》,54(2),119–135。
  46. Greenfield, P. M. (1997), 你无法将它随身带走:为什么能力评估无法跨越文化《美国心理学家》,52(10),1115–1124。
  47. Putnick, D. L. & Bornstein, M. H.(2016),测量不变性的惯例与报告:心理学研究的现状与未来方向发展评论,41,71–90。
  48. Mellenbergh, G. J.(1989),项目偏差与项目反应理论国际教育研究杂志,13(2),127–143。
  49. Protzko, J.(2025),测量不变性:测量不变性允许我们宣称什么?教育与心理测量,85(3),458–482。
  50. Aguinis, H. & Culpepper, S. A.(2024),增进我们对测验预测偏差的理解应用心理学杂志,109(3),402–414。
  51. Pedraza, O. & Mungas, D.(2008),跨文化神经心理学中的测量神经心理学评论,18(3),184–193。
  52. Manly, J. J. & Echemendia, R. J.(2007),种族特异性常模:运用高血压模型理解神经心理学中的种族、文化与教育问题临床神经心理学档案,22(3),319–325。
  53. Sireci, S. G., Scarpati, S. E. & Li, S.(2005),残障学生的测验便利措施:交互作用假设分析教育研究评论,75(4),457–490。
  54. Kane, M. T.(2013),验证对测验分数的解释和使用教育测量杂志,50(1),1–73。
  55. Caffrey, E., Fuchs, D. & Fuchs, L. S.(2008),动态评估的预测效度:综述特殊教育杂志,41(4),254–270。
  56. Dixon, C., Oxley, E., Gellert, A. S. & Nash, H.(2023),动态评估作为阅读发展的预测指标:系统性综述阅读与写作,36(3),673–698。
  57. Wood, E., Biggs, K. 和 Molnar, M. (2024),对不同背景学龄儿童词语阅读技能的动态评估:元分析,《ASHA 专题兴趣小组视角》,9(3),817–835。
  58. Earley, P. C. (2002),重新定义跨文化与跨组织互动:以文化智商推动发展,《组织行为研究》,24,271–299。
  59. Earley, P. C. 和 Ang, S. (2003),文化智商:跨文化的个体互动,斯坦福大学出版社。
  60. Ang, S. 等(2007),文化智商:其对文化判断与决策、文化适应和任务绩效的测量及影响,《管理与组织评论》,3(3),335–371。
  61. Van Dyne, L. 等(2012),文化智商四因素模型的子维度:拓展文化智商的概念化与测量,《社会与人格心理学指南》,6(4),295–313。
  62. Rockstuhl, T. 和 Van Dyne, L. (2018),文化智商四因素模型的双因素理论:元分析与理论拓展,《组织行为与人类决策过程》,148,124–144。
  63. Ward, C., Fischer, R., Zaid Lam, F. S. 和 Hall, L. (2009),文化智商自陈测量得分的聚合效度、区分效度和增量效度,《教育与心理测量》,69(1),85–105。
  64. Schlaegel, C., Richter, N. F. 和 Taras, V. (2021),文化智商与工作相关结果:联合效应和增量预测效度的元分析检验,《世界商业杂志》,56(4),101209。
  65. Tripathi, C. M., Kaurav, R. P. S. 和 Singh, T. (2024),你的文化智商如何促进适应?利用元分析揭示文化智商与跨文化适应之间的联系,《全球流动性杂志》,12(1),167–197。
  66. Ng, K.-Y., Rockstuhl, T. & Ang, S. (2025),语言能力与文化智力:基于资源保存理论和文化显性—隐性模型的元分析应用心理学,74(1),e12603。
  67. Li, C. (2022),跨文化培训对适应、文化智力和工作绩效影响的元分析国际职业发展,27(2),185–200。
  68. Erez, M. et al. (2013),走向全球:在文化多样性的虚拟团队中培养管理学学生的文化智力和全球认同管理学学习与教育学院,12(3),330–355。
  69. Fischer, R. (2011),跨文化培训对文化本质主义信念和文化智力的影响国际跨文化关系期刊,35(6),767–775。
  70. Tervalon, M. & Murray-García, J. (1998),文化谦逊与文化胜任力:多元文化教育中界定医师培训成果的关键区别贫困与弱势群体医疗保健期刊,9(2),117–125。
  71. Fang, F., Schei, V. & Selart, M. (2018),炒作还是希望?重新审视文化智力研究国际跨文化关系期刊,66,148–171。
  72. Lorenz, M. P. et al. (2020),文化智力的阴暗面:探究其对机会主义、伦理相对主义和客户关系绩效的影响商业伦理季刊,30(4),552–590。
  73. Durlak, J. A., Weissberg, R. P., Dymnicki, A. B., Taylor, R. D. & Schellinger, K. B. (2011),增强学生社会与情感学习的影响:基于学校的普遍性干预的元分析儿童发展,82(1),405–432。
  74. Taylor, R. D., Oberle, E., Durlak, J. A. & Weissberg, R. P. (2017),通过基于学校的社会与情感学习干预促进青少年积极发展:后续效应的元分析儿童发展,88(4),1156–1171。
  75. Cipriano, C. 等(2023),社会情感学习的证据现状:针对普遍性学校社会情感学习干预的当代荟萃分析,《儿童发展》,94(5),1181–1204。
  76. OECD(2024),更美好的生活所需的社会情感技能:OECD 2023年社会情感技能调查的发现,OECD 出版社。
  77. Edmondson, A.(1999),工作团队中的心理安全感与学习行为,《行政科学季刊》,44(2),350–383。
  78. Frazier, M. L.、Fainshmidt, S.、Klinger, R. L.、Pezeshkan, A. 和 Vracheva, V.(2017),心理安全感:荟萃分析综述与拓展,《人事心理学》,70(1),113–165。
  79. Duckworth, A. L. 和 Yeager, D. S.(2015),测量至关重要:为教育目的评估认知能力以外的个人特质,《教育研究者》,44(4),237–251。
  80. 欧盟(2024年;截至2026年7月27日的合并版本),制定人工智能统一规则的《欧盟条例》(EU)2024/1689,第5条第1款(f)项,《欧盟官方公报》。
  81. Mayer, J. D. 等(2025),使用 MSCEIT 2 测量情商:理论、依据与初步发现,《心理学前沿》,16,1539785。

证据审查截至2026年9月4日。 来源日期并不意味着证据权重相同。奠基性论文确立概念;测量研究检验分数所代表的内容;荟萃分析总结不同质量和范围的证据;专业或法律文件则规定特定用途。对于具有重大影响的评估或就业决策,请咨询最新手册、合格专业人士,并遵守相关司法管辖区适用的要求。

继续阅读《智力解放》子系列

深入探索每种观点

返回《智力解放》概览

以证据为依据编写的教育指南。最近一次证据审查:2026年9月4日。

返回博客