Measuring Intelligence

Измерение интеллекта

Linas Juozenas
Интеллект без ограничений · Измерение

Измерять интеллект, не сводя ум к одному показателю

Интеллект важен. Более развитые способности к рассуждению, памяти, накоплению знаний и обучению могут помогать людям больше понимать, быстрее учиться, решать более сложные задачи и с большей самостоятельностью справляться с жизнью. Хорошие тесты IQ способны измерять важные составляющие этих способностей. Они наиболее полезны, когда мы воспринимаем их как тщательно рассчитанные оценки, а не как личность, приговор или предел возможностей.

Что измеряет IQ Баллы и процентили Надёжность и валидность Справедливая интерпретация Дополнительные свидетельства Когнитивное развитие Уважайте исключительные умы
Основная идея

Полезный сигнал, интерпретируемый в контексте

Результат теста интеллекта — это выборка результатов выполнения отдельных когнитивных заданий в определённых условиях. Хорошо разработанные батареи тестов могут давать сведения о широких способностях, возможных относительных сильных сторонах и потребностях в поддержке, а также помогать направлять образование или последующее клиническое наблюдение. Их баллы значимы именно потому, что их утверждения ограничены и поддаются проверке.1

Правильный вопрос звучит не так: «Важен ли IQ или важен весь человек?» Важно и то и другое. Когнитивные способности влияют на обучение и многие жизненные результаты, тогда как достоинство, моральная ценность, цель и всё богатство ума нельзя свести к одному баллу.

Исключительный интеллект может иметь исключительное значение

Более высокий достоверный балл служит значимым свидетельством более сильных результатов в способностях, которые измеряет тест. Эта разница важна, и её не следует преуменьшать. В сочетании с любознательностью, дисциплиной, знаниями и мудростью исключительные когнитивные способности могут сделать человека необычайно значимым для других людей и общества — помогая ему замечать скрытые связи, решать сложные задачи, сохранять знания и направлять работу, которая иначе могла бы никогда не быть выполнена.

Один лишь балл не доказывает мудрость, характер или достижения, а базовое человеческое достоинство в равной мере принадлежит каждому. Но равное достоинство не требует делать вид, будто все способности или вклады одинаковы. Редкий интеллект и с трудом достигнутые интеллектуальные достижения заслуживают искреннего признания, защиты и уважения.

Знакомство с привычной шкалой IQ

Среднее значение многих современных сводных показателей нормировано на 100 и стандартное отклонение, равное 15. На иллюстрации ниже показаны приблизительные положения при нормальном распределении; обозначения и интерпретации различаются в зависимости от теста, его издания, возраста и нормативной группы.

7085100115130
Важно: на этой распространённой шкале 85 и 115 примерно на одно стандартное отклонение ниже и выше среднего соответственно. 115 не означает «на 15% умнее», чем 100: IQ — это стандартизированный показатель интервального типа, а не шкала отношений. Процентиль показывает относительное положение, а не процент правильных ответов, и каждый полученный показатель несёт неопределённость измерения.
01

Нормативный показатель

Показатель сравнивает результаты с подходящей стандартизационной выборкой, обычно с людьми того же возраста. Он не измеряет напрямую фиксированное количество «интеллекта».

02

Оценка, а не приговор

Надёжность никогда не бывает идеальной. В отчётах следует указывать доверительный интервал и объяснять, превышают ли небольшие различия ожидаемую погрешность измерения.

03

Профиль может добавить важный контекст

Надёжные различия между широкими областями могут подсказывать гипотезы об относительных сильных сторонах и потребностях в поддержке. Разброс результатов отдельных субтестов не следует рассматривать как диагностический признак.

01 · Значение

Что на самом деле измеряет тест на интеллект

Тестовая батарея на интеллект не заглядывает непосредственно в сознание. Она использует стандартизированные задания, чтобы вызвать определённое поведение, последовательно оценить его и выяснить, поддерживает ли получившийся профиль конкретную интерпретацию.

Большинство комплексных тестов интеллекта оценивает несколько когнитивных областей: рассуждение при работе с новой информацией, приобретённые вербальные знания, зрительно-пространственный анализ, рабочую память и эффективность обработки информации. Результаты выполнения этих заданий положительно коррелируют, что позволяет широкому композитному показателю обобщать существенное общее измерение когнитивного функционирования.2

Этот композитный показатель ценен, потому что конденсирует информацию. По той же причине он неполон. Мотивация, любознательность, творческие способности, эмоциональные навыки, практические знания, настойчивость, здоровье, ценности и возможности могут влиять на то, как человек использует свои способности, но не тождественны общим когнитивным способностям.

Сначала конструкт, потом число

Для каждой оценки нужно предложение, начинающееся так: «Этот результат свидетельствует о…» В конце следует назвать конструкт, совокупность людей, условия и предполагаемое применение. Если предложение превращается в «это число рассказывает нам всё об этом человеке», интерпретация выходит за пределы доказательств.

Краткий языковой ключ: конструкт — это способность, о которой делается вывод; батарея тестов — набор заданий; субтест оценивает более узкий навык; индекс объединяет связанные субтесты; композитный показатель обобщает более широкую совокупность характеристик; а нормативная группа — это референтная выборка, используемая для интерпретации положения человека.

Четыре термина, помогающие избежать распространённых недоразумений
Термин Что это означает Чего это не означает
Необработанная оценка Правильно выполненные задания или набранные баллы до преобразования по нормам. Показатель, непосредственно сопоставимый для разных возрастов, редакций или тестов.
Стандартизированная оценка Преобразованная оценка, расположенная в референтном распределении. Процент всего имеющегося интеллекта.
Процентильный ранг Приблизительный процент участников нормативной группы, набравших столько же или меньше. Процент правильных ответов или процент, на который один человек «умнее».
Доверительный интервал Диапазон, учитывающий неопределённость наблюдаемой оценки. Гарантия того, что скрытая «истинная оценка» навсегда фиксирована внутри диапазона.
02 · Качество теста

Как надёжный тест получает право на доверие

Отточенный интерфейс, сложные головоломки или пометка «на основе ИИ» не делают тест интеллекта валидным. Доверие формируется документально подтверждёнными доказательствами.

Чётко определённый конструкт

Разработчик определяет, какие способности предназначен измерять тест, что он намеренно не охватывает и какие интерпретации подтверждаются.

Стандартизированное проведение

Инструкции, время выполнения, стимулы, правила подсчёта баллов и условия тестирования контролируются, чтобы результаты оставались сопоставимыми.

Соответствующие нормы

Достаточно большая и релевантная выборка служит основой для интерпретации. Устаревшие или плохо соответствующие нормам могут искажать положение человека.

Надёжность

Показатели достаточно согласованы между заданиями, формами, экспертами или случаями тестирования для принятия предполагаемого решения. Чем выше значимость решения, тем выше требуемая точность.

Доказательства валидности

Содержание, процессы ответа, внутренняя структура, связи с другими переменными и последствия подтверждают предлагаемую интерпретацию и применение.

Справедливость и доступность

Разработчики изучают барьеры, функционирование заданий в разных подгруппах и адаптации, а затем указывают, где доказательства слабы или применение неуместно.

Надёжность необходима, но недостаточна

Весы, которые всегда показывают на пять килограммов меньше или больше, надёжны, но неточны. Точно так же когнитивный тест может стабильно ранжировать результаты, не оправдывая каждую интерпретацию, сделанную на его основе. Профессиональные стандарты рассматривают валидность как доказательства, поддерживающие конкретную интерпретацию для конкретного применения, а не как постоянную наклейку на инструменте.1

Стандартная ошибка и доверительные интервалы

Поскольку при тестировании оценивается выборка поведения, наблюдаемый показатель содержит неопределённость. Доверительный интервал выражает эту неточность с учётом надёжности теста и шкалы показателей. Интервал не охватывает все возможные источники ошибки — такие как плохой сон, неверно понятые инструкции, языковое несоответствие или нетипичный сеанс тестирования, — но он честнее, чем представление одного числа как точного.

Упрощённый пример

В классической теории тестов стандартную ошибку измерения можно проиллюстрировать формулой SD × √(1 − надёжность). На шкале SD-15 при надёжности .95 она составляет около 3,35 балла. В этом упрощённом примере наблюдаемый показатель 120 имел бы приблизительный 95%-й интервал 113–127.

Почему важна «упрощённость»

При интерпретации следует использовать указанные в руководстве оценки стандартной ошибки с учётом возраста, показателя и редакции. Точность может различаться по всей шкале, особенно вблизи крайних значений. Показатели изменений и различий также имеют собственную погрешность, и их нельзя оценивать только по надёжности одного из показателей.1

Когда два индексных показателя различаются, специалист должен спросить не только о том, достигает ли разница статистического порога. Как часто разница такого масштаба встречается в нормативной выборке? Сохраняется ли она в связанных заданиях и в анамнезе? Имеет ли она отношение к вопросу, послужившему основанием для обследования? Иначе впечатляющий профиль может превратиться в историю, построенную на обычной вариативности.

03 · История

Инструмент поддержки, история прогресса — и предупреждение о власти

Тестирование интеллекта не возникло в одном завершённом виде. Его история включает гуманные образовательные цели, значительные технические достижения, необоснованные экстраполяции и принудительное неправомерное использование. Понимание всех четырёх аспектов помогает нам лучше применять измерения сегодня.

1905–1908Бине—Симон

Предшественник с 30 заданиями развивается в более полную шкалу с градацией по возрасту для выявления детей, которым может потребоваться иное обучение.

1912Коэффициент Штерна

Уильям Штерн предлагает термин «коэффициент интеллекта»: умственный возраст, делённый на хронологический возраст.

1916Редакция Стэнфорда

Льюис Терман адаптирует и расширяет шкалу для США и популяризирует целочисленный коэффициент IQ.

С 1939 годаБатареи Векслера

Тестирование взрослых объединяет вербальные задания и задания на выполнение и развивает нормирование показателей отклонения по возрасту.

СегодняПрофили + неопределённость

Современные батареи тестов предоставляют сводные показатели и баллы по отдельным областям, сопоставленные с заданными нормами, а также данные о надёжности и валидности.

Бине и Симон: текущие результаты, а не неизменная судьба

В 1905 году Альфред Бине и Теодор Симон опубликовали влиятельный прообраз шкалы из 30 заданий; их более полная редакция 1908 года распределяла задания по возрастным уровням и больше напоминала практическую шкалу интеллекта, которую позднее описывали учебники. Эта работа возникла из французских споров о том, как выявлять и обучать детей, испытывающих трудности в обычных классах. Задания проверяли такие способности, как понимание, память и суждение, чтобы более системно выявлять текущие потребности.34

Это ещё не был современный тест IQ и не давал более позднего коэффициента Штерна. Бине описывал шкалу как практическую иерархию, а не как буквальное измерение вроде физической длины, и выступал против того, чтобы считать низкий результат доказательством неизменной способности. Эту осторожность не следует романтизировать, превращая её в утверждение, будто любая способность может расти без ограничений. Её непреходящая ценность проще: результат должен помогать определить необходимую поддержку, а не становиться приговором.

Штерн, Терман и число, названное IQ

В 1912 году немецкий психолог Вильям Штерн предложил термин Intelligenzquotient: оценочный умственный возраст, разделённый на хронологический возраст. В редакции Стэнфордской шкалы 1916 года Льюис Терман принял этот коэффициент, умножил его на 100 и помог сделать «IQ» широко известным в американском образовании.56 Эти ранние показатели были коэффициентами IQ. Это ещё не были современные показатели отклонения, которые определяют положение результата в нормативном распределении для соответствующего возраста.

Массовое тестирование и опасность экстраполяции

Во время Первой мировой войны Army Alpha тестировал англоязычных грамотных новобранцев группами, тогда как преимущественно наглядный Army Beta предназначался для новобранцев с ограниченной грамотностью или слабым знанием английского языка. Эта программа показала, что психологические тесты можно проводить в огромных масштабах, и служила практическим задачам классификации.7

Историческая ошибка произошла тогда, когда показатели, на которые влияли язык, школьное образование, аккультурация, отбор и условия тестирования, стали использовать для утверждений о врождённой расовой или национальной иерархии. Интерпретация данных армии Карлом Бригамом в 1923 году стала ярким примером; к 1930 году он отверг сравнительную основу этих выводов. Расизированные интерпретации тестов придали видимость научной обоснованности более широкой евгенической и нативистской культуре, хотя утверждения о том, что армейское тестирование непосредственно привело к принятию Закона США об иммиграции 1924 года, преувеличивают архивные свидетельства.89

Урок — в точности, правах и самостоятельности

Евгеника ранжировала жизни людей и лишала их самостоятельности посредством сегрегации, исключения и принуждения к деторождению. Помощь людям в укреплении когнитивных способностей с помощью образования, питания, медицинской помощи, безопасности и добровольно выбранной практики делает обратное: расширяет самостоятельность. Прославление интеллектуального развития совместимо с равенством людей, когда способности развиваются и используются во благо, — но их не следует смешивать с чьим-либо правом на достоинство.

Векслер и современный профиль с возрастными нормами

Шкала Векслера—Бельвью 1939 года, разработанная Дэвидом Векслером, предназначалась для клинического применения у взрослых. Она объединяла вербальные задания и задания на выполнение и сравнивала взрослых с людьми того же возраста, помогая отойти от буквального соотношения умственного и хронологического возраста. В 1949 году для детей появилась WISC, а в 1955 году — первая WAIS.10 В более поздних батареях широкий композитный показатель всё чаще сочетался с интерпретируемыми показателями отдельных областей — такая архитектура остаётся центральной и сегодня.

04 · Модели

Как соотносятся общие и специфические способности

Согласно широко распространённому психометрическому подходу, структура иерархична: когнитивные задачи имеют нечто общее, но разные задачи также требуют более специфических способностей.

Общий фактор, g

Люди, хорошо выполняющие одну достаточно сложную когнитивную задачу, в среднем склонны хорошо выполнять и другие. Факторный анализ обобщает эту положительную закономерность с помощью общего фактора, который обычно называют gЭта закономерность — один из наиболее воспроизводимых результатов в психологии.2

g — это статистическая закономерность, а не маленькая субстанция, расположенная в одной области мозга, и теории расходятся во мнениях относительно механизмов, которые её порождают. Её полезность не требует делать вид, будто эти механизмы полностью изучены.

Широкие и узкие способности

Иерархические модели, такие как Кэттелла—Хорна—Кэрролла, организуют показатели от общего уровня к широким способностям и более узким навыкам. Текучий интеллект и приобретённые знания — заметные примеры; к другим областям могут относиться зрительная переработка, кратковременная рабочая память, беглость извлечения и скорость обработки.11

CHC лучше понимать как таксономию, основанную на психометрических данных, а не как утверждение, что каждая батарея идеально реализует одну и ту же карту.

Композитный показатель отвечает на вопрос: «Какую общую закономерность можно наиболее обоснованно подтвердить?» Профиль отвечает на вопрос: «Есть ли различия между широкими областями, которые достаточно надёжны, необычны и подтверждены несколькими источниками, чтобы на их основе выдвинуть гипотезу?»
Два уровня интерпретации, а не конкурирующие определения

На конкретные показатели стоит обращать внимание, если они достаточно надёжны, представлены более чем одним заданием и дают значимую дополнительную информацию сверх композитного показателя для предполагаемого применения. Им следует уделять меньше внимания, если кажущийся пик или спад зависит от одного короткого субтеста. Широкие показатели часто надёжнее; более узкие могут помочь спланировать целевое дальнейшее обследование, но не следует заранее предполагать их учебную или клиническую полезность.

05 · Современные батареи

Что могут оценивать современные тесты интеллекта

Батареи различаются по возрастному диапазону, назначению и теоретической основе. Ниже перечислены области, отражающие распространённые цели, а не универсальную структуру, общую для каждого теста.

Типичные области и вопросы, на которые они помогают ответить
Область Типичная нагрузка Осторожность при интерпретации
Гибкое мышление Выявлять правила, устанавливать связи и решать незнакомые задачи. Важны и предшествующее знакомство с форматом головоломок, и стратегия, и инструкции.
Приобретённые знания / вербальное понимание Использовать словарный запас, понятия и знания, передаваемые культурой. Язык, образование и возможности для обучения являются неотъемлемыми факторами успешности.
Зрительно-пространственная обработка Анализировать, преобразовывать или конструировать пространственные образы. На результаты могут влиять зрение, моторная реакция и опыт работы со схемами.
Рабочая память Удерживать и преобразовывать информацию в течение коротких интервалов. На краткий результат могут влиять внимание, слух, тревожность и стратегия.
Скорость обработки Точно и эффективно выполнять простые зрительные решения в условиях ограничения времени. На результат могут влиять скорость моторных реакций, зрительный доступ и осторожный стиль реагирования.
Долговременное извлечение / беглость Извлекать усвоенные ассоциации или эффективно генерировать информацию. На результаты влияют объём знаний, язык и практика выполнения конкретных заданий.

К примерам профессионально разработанных инструментов относятся шкалы Стэнфорд—Бине, шкалы Векслера, когнитивная батарея Вудкока—Джонсона, батареи Кауфмана и матрицы Равена. Одного названия бренда недостаточно. Важны подходящая редакция, возрастной диапазон, язык, нормативы, квалификация экзаменатора и предполагаемое применение. Например, актуальная батарея Векслера для взрослых в США — WAIS–5, но доступность и одобренные версии различаются по странам.12

Скрининг — это не комплексная оценка

Краткий скрининговый тест может показать, целесообразно ли более полное обследование. Невербальное задание с матрицами позволяет оценить абстрактное мышление при меньшей языковой нагрузке. Онлайн-викторина может быть занимательной или познавательной. Но ни одно из них автоматически не обладает широтой охвата, контролируемыми условиями проведения, защищёнными заданиями, репрезентативными нормами и доказательной базой для интерпретации, характерными для профессионально проведённой батареи тестов.

06 · Интерпретация

Как читать отчёт о когнитивной оценке

Ответственный отчёт превращает числа в обоснованные выводы с чёткими границами, проверяет альтернативные объяснения и связывает результаты с полезными действиями.

Начните с вопроса, послужившего основанием для направления

  • Почему была запрошена оценка?
  • Какой тест и какая редакция использовались, и подходят ли они для данного случая?
  • Кто входил в нормативную выборку и когда собирались нормативные данные?
  • Были ли проведение и оценивание стандартизированы?
  • Отражали ли результаты обычное функционирование?

Затем переходите от общего к частному

  • Суммарный показатель и доверительный интервал
  • Надёжные, значимые различия между индексами
  • Сходящиеся результаты субтестов — а не отдельные высокие или низкие показатели
  • Поведенческие наблюдения и условия тестирования
  • Согласованность с историей обучения, работы и повседневной жизни

Общий показатель по шкале и профиль индексов

Обобщённый суммарный показатель часто является наиболее надёжным кратким отражением общей результативности. Значительные и устойчивые различия между областями могут дополнять его клинически значимой информацией, но сама по себе неоднородность профиля не обесценивает суммарный показатель. Неравномерный профиль автоматически не подтверждает наличие конкретного расстройства, равно как и самый высокий балл не обязательно является «истинным IQ» человека. Специалист должен определить, являются ли различия статистически надёжными, достаточно необычными, чтобы заслуживать внимания, и подтверждаются ли независимыми данными.

Результаты зависят от условий

Недосыпание, боль, острое заболевание, тревожность, депрессия, действие лекарств, нарушения слуха или зрения, двигательные требования, незнакомый язык, прерванное образование, низкая вовлечённость и непонимание инструкций — всё это может влиять на наблюдаемые результаты. Некоторые из этих состояний относятся к реальному функционированию, которое исследуется; другие являются несущественными препятствиями. При интерпретации их следует различать, а не автоматически прибавлять или вычитать баллы.

Повторное тестирование и эффекты практики

Более высокий результат при повторном тестировании может быть связан с запомнившимся форматом, новыми стратегиями, снижением тревожности или совпадающими заданиями. Эти эффекты практики действительно улучшают результаты тестирования, но не обязательно отражают эквивалентное повышение общих лежащих в основе способностей. Величина эффекта зависит от интервала, возраста, теста и предыдущего опыта; альтернативные формы и надлежащие рекомендации по повторному тестированию помогают.17

Запрашивайте полезную информацию о неопределённости

Хорошее объяснение звучит так: «Результат в этой области оценён в таком-то диапазоне; вероятно, он значим, поскольку эти задания согласуются друг с другом и с историей человека. На него могли повлиять следующие условия. Вот что, согласно результату, нам следует попробовать дальше».

07 · Прогностическая сила

Что предсказывает IQ — и чего он не предсказывает

Общие когнитивные способности имеют значение. В группах они предсказывают вероятности, а не предопределённые биографии отдельных людей.

Обучение

Умение рассуждать, знания и память облегчают понимание инструкций, установление связей между идеями и освоение сложных навыков. Когнитивные способности существенно связаны с успеваемостью в школе.2

Сложная работа

Общие умственные способности предсказывают успешность работы, хотя пересмотренные оценки метаанализа более умеренны, чем некоторые прежние утверждения.14

Ориентирование в жизни

В разных популяциях более высокие когнитивные показатели связаны с уровнем образования, сложностью профессиональной деятельности, а также с некоторыми показателями здоровья и продолжительности жизни. Эти связи формируются под влиянием множества индивидуальных и социальных факторов; они не определяют будущее человека.2

Корреляция — не личное пророчество

Корреляция описывает, как переменные обычно изменяются вместе в пределах популяции. Она не означает, что балл сам по себе вызывает определённый результат или что все люди с одинаковым баллом проживут одинаковую жизнь. Качество образования, здоровье, семейные ресурсы, личность, интересы, дискриминация, мотивация, отношения, ценности и случайности влияют на то, какие возможности появляются и как используются способности.

Даже сильная связь оставляет огромный простор для индивидуальных различий. И наоборот, утверждение, что IQ — это «не всё», никогда не следует искажать до утверждения, что он не значит ничего. Способности, поддерживающие понимание, рассуждение и обучение, заслуживают защиты, развития и признания.

Соразмерность выводов доказательствам
Что доказательства могут подтвердить Что доказательства сами по себе подтвердить не могут
Оценка отдельных общих и специфических для предметной области когнитивных способностей. Полное описание сознания, личности, мудрости или творческих способностей.
Вероятностные прогнозы релевантных результатов для валидированных популяций. Определённые прогнозы будущего одного человека.
Выявление некоторых сильных сторон, потребностей или расхождений в обучении. Автоматический диагноз или определение образовательного маршрута без других доказательств.
Свидетельство изменений, если учтены методы, нормы, неопределённость и эффекты повторного тестирования. Утверждение, что каждое изменение баллов означает широкий интеллектуальный рост, или что рост невозможен.
Основание для предоставления сложных задач, возможностей, признания или целевой поддержки, а также для защиты редких способностей от растраты или ненужного вреда. Полный рейтинг человеческого достоинства или основных прав; их не присваивают на основании психометрического балла.
08 · Справедливость

Культура, язык, инвалидность и доступность

Справедливость — не декоративная финальная проверка. Она является частью вопроса о том, насколько обоснована предлагаемая интерпретация баллов для этого человека, данной популяции и конкретной цели.

Ни одна оценка не свободна от влияния культуры. На результаты могут влиять язык, школьное образование, знакомство с тестированием, визуальные условности, доступ к технологиям, ожидания относительно скорости, мотивация и отношения к представителям власти. Это не означает, что каждое различие в баллах является «предвзятостью», и групповое различие не доказывает ни наличия предвзятости, ни различий во врождённых способностях. Эмпирический вопрос заключается в том, искажают ли нерелевантные препятствия существенным образом тот конструкт, который призван измерять тест.

Социальный контекст может влиять на результаты, но размеры эффектов не универсальны

Обеспокоенность тем, что подтверждение негативного стереотипа о группе может иногда отвлекать внимание или менять вовлечённость во время тестирования. В исследованиях это называют угрозой стереотипа. Метаанализ исследований девочек младше 18 лет при тестировании математических, естественно-научных и пространственных способностей выявил небольшой средний эффект, но серьёзные признаки систематической ошибки публикаций; эти результаты не следует обобщать до единого масштабного объяснения различий между любыми группами или различий в баллах.34 Практический вывод шире: уважительное проведение тестирования, психологическая безопасность и справедливая возможность понять задание повышают качество доказательств для всех.

Справедливость необходимо исследовать на нескольких уровнях
Уровень Вопрос
Доступ и проведение Может ли человек воспринимать, понимать и отвечать без нерелевантного языкового, сенсорного, моторного или технологического барьера?
Задание Имеют ли одинаково способные представители разных групп разную вероятность правильно ответить на конкретное задание?
Шкала / конструкт Функционирует ли лежащая в основе структура достаточно сопоставимо в разных группах для предполагаемого сравнения?
Нормы Является ли референтная выборка релевантной, современной, достаточно репрезентативной и прозрачно описанной?
Решение / результат Предсказывает ли балл релевантные критерии и классифицирует ли людей с приемлемой точностью, в том числе вблизи пороговых значений?

Дифференциальное функционирование заданий — это сигнал к дальнейшему изучению

Дифференциальное функционирование заданий (DIF) возникает, когда люди из разных групп, сопоставимые по измеряемой способности, тем не менее имеют разную вероятность ответить на задание определённым образом. DIF не доказывает наличие смещения автоматически: специалисты оценивают его величину, содержание, возможную причину и влияние на итоговые баллы. Автоматическое удаление каждого задания, для которого выявлен DIF, также может ухудшить охват содержания.

Измерительная инвариантность показывает, означают ли сравнения одно и то же

Анализ инвариантности изучает, одинаково ли функционируют факторная структура теста, взаимосвязи и уровни баллов в разных группах. Разные уровни инвариантности позволяют делать разные выводы; доказательства, достаточные для сравнения взаимосвязей, могут быть недостаточны для сравнения средних значений групп. Инвариантность — ценное модельное доказательство, но не доказательство того, что исчезли все социальные или измерительные проблемы.21

Перевод — это не адаптация

Перевод методики должен сохранять не только слова. Культурной и эмпирической проверке необходимо подвергнуть смысл конструкта, инструкции, примеры, графику, форматы ответов, подсчёт баллов, нормы и процедуру проведения. Обратный перевод может помочь выявить расхождения, но сам по себе не может установить эквивалентность. Руководство Международной комиссии по тестированию рекомендует привлекать специалистов разных профилей, проводить пилотные исследования и собирать доказательства на уровнях заданий, метода и конструкта.20

«Невербальный» означает сниженную языковую нагрузку, а не нейтральный контекст

Тесты, такие как матричное мышление, могут снизить зависимость от словарного запаса и усвоенных вербальных знаний. Однако их инструкции, абстрактные визуальные условности, скорость, моторная реакция и знакомство с головоломками по-прежнему отражают предыдущий опыт. Для них нужны такие же специфичные для популяции доказательства надёжности, валидности, стандартизации и справедливости, как и для вербальных методик.

Адаптация условий

Изменение, призванное устранить барьер, не относящийся к конструкту, при сохранении смысла балла. Оно должно быть индивидуализированным, документированным и обоснованным доказательствами.

Модификация

Изменение, которое меняет целевой конструкт или стандартизированное сравнение. Оно может быть гуманным и полезным, но получившийся балл может быть несопоставим с исходными нормами.

Дополнительное время может сохранять сопоставимость, если скорость не имеет значения; когда же скорость обработки является проверяемым конструктом, оно может изменить смысл балла или сделать неприменимыми стандартные нормы для тестирования на время. Такая же осторожность необходима при использовании переводчиков, чтецов, секретарей, альтернативных интерфейсов и упрощённых инструкций. Идентичная процедура проведения не всегда справедлива; изменённая процедура не становится автоматически валидной.22

Для справедливости нужны и знания сообщества, и психометрические данные

Консультации с учителями, семьями и членами сообщества могут помочь выявить недоступные формулировки, отсутствующие местные знания или вредные предположения, которые разработчики, находящиеся далеко от места применения, могут упустить. Такие сведения должны порождать гипотезы для документированных исследований доступности, стандартизации, надёжности, валидности и результатов; сами по себе они не устанавливают справедливость.120

09 · Решения

Чем выше ставки, тем надёжнее должны быть меры предосторожности

Один и тот же балл может быть приемлемым для исследования групповых закономерностей, но слишком неточным для принятия решения об образовании, диагнозе, трудоустройстве или доступе к услугам конкретного человека.

Психологическое тестирование — лишь один из компонентов оценки. Значимый вывод должен учитывать вопрос, послуживший основанием для обследования, личный и возрастной анамнез, наблюдаемое поведение, соответствующие документы и другие показатели, не позволяя одному числу незаметно превратиться в решающий фактор.13

1

Используйте несколько источников

Сочетайте результаты когнитивного тестирования с релевантными данными об учебных достижениях, историей развития, наблюдениями, интервью, образцами работ или данными об адаптивном функционировании.

2

Учитывайте неопределённость

Изучите доверительные интервалы, надёжность различий и ошибку классификации вблизи любого порогового значения.

3

Проверьте соответствие

Проверьте язык, нормы, доступность, компетентность специалиста, проводящего обследование, а также данные о валидности для этой группы и данного применения.

4

Создайте путь вперёд

Результат должен вести к подходящим по сложности задачам, поддержке, обучению или дальнейшему изучению — а не к ярлыку, ставящему точку.

Интеллектуальная недостаточность не диагностируется только по показателю IQ

Современные определения требуют наличия значительных ограничений как интеллектуального функционирования, так и адаптивного поведения, возникших в период развития. Адаптивное поведение охватывает концептуальные, социальные и практические навыки, используемые в повседневной жизни. Также важны культура, язык, ожидания сообщества, сильные стороны и потребность в поддержке.23 Балл около 70 может служить важным подтверждением; сам по себе он не является достаточным основанием для диагноза.

Одарённость и расширенные образовательные возможности также требуют совокупности подтверждающих данных

Высокие показатели когнитивных способностей могут выявить исключительные способности к рассуждению и обучению, которые заслуживают более сложных задач. Но жёсткое применение одного порогового значения может не выявить учащихся, у которых язык, инвалидность, доступ к образованию или неравномерный профиль снижают совокупный балл. Несколько показателей могут улучшить как выявление, так и планирование: баллы по отдельным областям, учебные достижения, портфолио, свидетельства учителей, темп обучения и продемонстрированные творческие работы — всё это может иметь значение для заявленной цели программы.

Отбор и трудоустройство

Когда когнитивные тесты используются при найме, измеряемые способности должны иметь доказуемую связь с работой, процедуры должны соответствовать применимому законодательству, а неблагоприятные последствия следует проверять. Корреляция, предсказывающая результат на уровне группы, не освобождает организацию от соблюдения требований доступности, справедливости, конфиденциальности и прозрачности, а также от проверки человеком.

Никогда не позволяйте порогу выдавать себя за природный факт

Административные пороговые значения — это решения людей, применяемые к измерениям с неопределённостью. Вблизи порога небольшие изменения в состоянии здоровья, нормативах, форме теста или погрешности измерения могут изменить категорию. Чем ближе результат к значимой границе, тем важнее становятся подтверждающие данные и дополнительная проверка.

10 · Более широкая панель показателей

Дополняющие друг друга оценки отвечают на разные вопросы

Ответом на неполную оценку не может быть ещё более расплывчатый «показатель целостной личности». Нужен целенаправленный набор показателей, каждый из которых используется для того конструкта, который он позволяет обоснованно оценить.

Сохраняйте различия между показателями

Не смешивайте разные виды свидетельств. Когнитивные способности, учебные достижения, исполнительные функции, адаптивное поведение, креативность, эмоциональные навыки и подтверждённые результаты работы — это не взаимозаменяемые компоненты, которые можно усреднить в одно универсальное число. Панель показателей сохраняет значение каждого результата и выявляет ценностные суждения, лежащие в основе любого решения.

Выбирайте метод, соответствующий вопросу
Метод Основной вопрос Важное ограничение
Оценка учебных достижений Какие знания или навыки этот человек приобрёл в чтении, математике, естественных науках или другой области? Отражает учебную программу, преподавание, язык и возможности обучения, а не чистую способность.
Задания и оценки исполнительных функций Как человек подавляет реакции, переключается, сохраняет цели и управляет рабочей информацией при выполнении заданий или в повседневной жизни? Краткие лабораторные задания и оценки поведения в реальной жизни часто отражают разные аспекты, и их не следует считать эквивалентными.25
Шкалы адаптивного поведения Насколько самостоятельно и эффективно человек использует концептуальные, социальные и практические навыки в повседневной жизни? Оценки зависят от возможностей, контекста, ожиданий и информантов; ценную информацию дают несколько источников.
Динамическая оценка Как меняется результативность человека при подсказках, обучении или использовании опор? Проведение занимает больше времени и отличается меньшей стандартизированностью; улучшение может зависеть от конкретного задания и квалификации экзаменатора.26
Оценка креативности Способен ли человек генерировать, оценивать и улучшать оригинальные и эффективные идеи в определённой области? Задания на дивергентное мышление оценивают творческий потенциал, а не всю творческую биографию или будущие достижения.
Оценка эмоциональных навыков Насколько хорошо человек воспринимает, понимает или регулирует эмоциональную информацию — или как он описывает свои типичные эмоциональные склонности? Тесты способностей, самоотчёты о чертах личности и смешанные модели «эмоционального интеллекта» измеряют разные конструкты.
Портфолио и образцы работ Что человек фактически написал, спроектировал, построил, исполнил или решил с течением времени? На результаты могут влиять отбор, обучение, доступные ресурсы и суждения оценивающих; единые критерии и несколько выборок помогают.

Исполнительные функции: выполнение заданий и повседневная саморегуляция

Исполнительные функции включают отдельные, но связанные аспекты целенаправленного контроля, которые часто описывают через торможение, переключение и обновление рабочей памяти. Задания на выполнение могут выявить обработку информации в контролируемых условиях, а оценки самого человека, родителей или учителей — показать успешность повседневного достижения целей. Их умеренное совпадение означает, что расхождение даёт ценную информацию и не обязательно является ошибкой: разные методы могут отражать разные уровни поведения.2425

Динамическая оценка: наблюдайте за обучением, а не только за исходным уровнем

Процедуры «тест — обучение — повторный тест» и поэтапные подсказки позволяют изучать, как учащийся реагирует на руководство. Это может выявить стратегии, виды необходимой поддержки и восприимчивость к обучению, чего нельзя увидеть по статичному баллу. Такой подход особенно полезен, когда предшествующие возможности, язык или обучение затрудняют интерпретацию. Данные зависят от метода и исследуемой группы, поэтому динамическая оценка дополняет стандартизированные данные, а не устраняет предвзятость.

Креативность: оригинальность в сочетании с эффективностью

Креативность — это не просто создание множества необычных ответов. При серьёзной оценке идеи также должны быть полезными, эффективными или уместными в определённой области. Можно сочетать открытые задания, реальные продукты деятельности, портфолио, экспертные оценки и сведения о творческой активности. Когнитивные способности и творческие достижения положительно связаны, но далеко не идентичны — именно поэтому оба показателя могут дать дополнительную информацию.2728

Эмоциональный интеллект: уточняйте, о какой модели идёт речь

Эмоциональный интеллект как способность

Задания на выполнение, предназначенные для оценки восприятия, использования, понимания или управления эмоциональной информацией.

Эмоциональный интеллект как черта

Самооценка типичных склонностей и представлений о себе, связанных с эмоциями.

Смешанные модели

Более широкие сочетания навыков, личностных особенностей, мотивации и социального поведения, которые часто продвигаются под единым обозначением EQ.

Эти группы не следует сравнивать так, будто они измеряются по одной шкале. Эмоциональные навыки могут способствовать отношениям, обучению и результативности, тогда как когнитивные способности измеряют нечто иное. Данные указывают на умеренную связь между показателями эмоционального интеллекта и академической успеваемостью; дополнительная прогностическая ценность после учёта когнитивных способностей и личности зависит от используемого инструмента и остаётся ограниченной.2930

Множественный интеллект: гуманная идея, а не валидированная диагностическая карта

Подход Говарда Гарднера побуждал педагогов замечать также музыкальные, телесно-кинестетические, межличностные, пространственные и другие способности, которые слишком часто игнорируются узкими рамками занятий в классе. Этот образовательный посыл может быть ценным. Однако имеющиеся данные не подтверждают, что предложенные виды интеллекта представляют собой независимые психометрические системы, а популярные онлайн-«тесты множественного интеллекта» не должны закреплять за детьми ярлыки определённых стилей обучения. Используйте этот подход, чтобы расширить возможности, а не заменить валидированные оценки когнитивных способностей или навыков.31

IQ оценивает широкий и полезный профиль когнитивной деятельности. Учебные достижения показывают освоенные знания и навыки; показатели исполнительных функций оценивают контроль; адаптивные шкалы отражают повседневное функционирование; динамическая оценка показывает реакцию на обучение; тесты креативности и эмоциональных способностей оценивают другие стороны; портфолио показывает, что человек действительно создал или сделал.
Ни один отдельный результат не даёт полной картины
11 · Развитие

Могут ли развиваться интеллект и IQ?

Да, но это разные утверждения. Когнитивные способности могут развиваться, а нормированный по возрасту IQ может изменяться. Чтобы показать устойчивый широкий рост, нужны доказательства, выходящие за рамки взросления, погрешности измерения, изменившихся норм и знакомства с одним тестом.

Развитие заслуживает признания

Когда люди расширяют знания, учатся рассуждать в незнакомых ситуациях, совершенствуют стратегии запоминания или приобретают когнитивные инструменты, позволяющие быстрее и точнее понимать мир, преимущества могут проявляться в образовании, работе, принятии решений, отношениях и самостоятельности.

Измерение должно помогать нам признавать достижения, а не отрицать их из-за частичной стабильности интеллекта и не преувеличивать их из-за повышения результата по одному отработанному тесту.

Образование имеет наиболее убедительные общие доказательства

Крупный метаанализ, уделявший особое внимание квазиэкспериментальным исследованиям, показал, что дополнительный год образования давал в среднем примерно 1–5 баллов IQ — в зависимости от дизайна исследования и допущений — более чем у 600 000 участников. Эффекты наблюдались в широком спектре когнитивных категорий и на протяжении всей жизни.15

Это оценка для популяции, а не ежегодное обещание каждому человеку и не неограниченный линейный закон. Это убедительное свидетельство против того, чтобы считать измеренный интеллект неизменным.

Стабильность и изменения совместимы

Когнитивные способности демонстрируют всё большую стабильность рангов с детства до взрослого возраста: люди часто сохраняют в целом схожее положение относительно сверстников. Это не означает, что абсолютные показатели никогда не меняются, что среда не имеет значения или что среднее значение в группе не может сдвигаться. Наиболее полный недавний метаанализ выявил высокую, но не идеальную стабильность с конца подросткового возраста на протяжении большей части взрослой жизни.19

Результаты в популяции менялись от поколения к поколению

На протяжении значительной части XX века результаты многих тестов интеллекта повышались — это называют эффектом Флинна. Метаанализ, охвативший 31 страну, выявил различия в приросте в зависимости от когнитивной области, места и периода; в последние десятилетия тенденции стали слабее.16 Поэтому тесты необходимо периодически перенормировать. Это не означает, что каждое новое поколение во всех смыслах мудрее предыдущего, и не существует универсальной поправки «три балла за десятилетие» для любого результата.

Не каждое улучшение означает одно и то же
Вид улучшения Что изменилось Наилучшие доказательства
Улучшение от практики Результаты выполнения повторяющихся или очень похожих заданий. Полезно для освоения этой задачи; не делайте вывод о широком переносе без дополнительных данных.
Улучшение навыка Тренируемая область, например арифметика, словарный запас, пространственная стратегия или процедура поддержания внимания. Непрактиковавшиеся показатели того же навыка и устойчивые результаты в реальной жизни.
Широкое когнитивное улучшение Способности обобщаются на существенно различающиеся задачи или области. Альтернативные показатели, по возможности активные контрольные группы и последующее наблюдение в течение времени.
Нормативное изменение IQ Изменения положения относительно сверстников того же возраста. Сопоставимые актуальные нормы; доверительные интервалы; данные о надёжном изменении и повторном тестировании.

Тренировка мозга: цените реальное улучшение и честно называйте его

Коммерческие тренировки мозга часто улучшают выполнение отрабатываемой задачи и иногда — близких к ней задач. Дальний перенос на общий интеллект обычно слаб или непоследователен в хорошо контролируемых обзорах.18 Улучшение в конкретной области всё же может быть полезным. Точность защищает прогресс: если называть каждое улучшение «повышением IQ», становится труднее распознавать реальные изменения.

Условия, поддерживающие обучение и когнитивное функционирование

Учитесь глубоко

Формируйте знания, неоднократно извлекайте их из памяти, объясняйте, связывайте между собой и применяйте в новых задачах.

Берегите мозг

Ставьте в приоритет сон, физическое здоровье, движение, питание, безопасность и устранение препятствий для внимания или обучения.

Ищите вызовы

Работайте немного за пределами текущего уровня освоения, используя обратную связь, поэтапную поддержку и достаточное время для закрепления.

Отслеживайте перенос

Ищите устойчивое улучшение при выполнении новых задач, в реальной работе и повседневном понимании, а не только при знакомом упражнении.

Гены влияют на когнитивные различия, но наследуемость — это статистический показатель для популяции в определённом диапазоне условий среды; это не доля интеллекта конкретного человека, «обусловленная генами», и не доказательство того, что образование не может помочь.2 Стабильность описывает закономерность. Она не означает, что рост невозможен.

12 · Оригинальность и принадлежность

Одиночество помогает сформировать идею; сообщество — воплотить её в жизнь

Оригинальное мышление и социальные связи не враждуют друг с другом. Они часто относятся к разным этапам одного и того же творческого цикла.

Защищённое блуждание мысли

Время наедине с собой позволяет освободить внимание от непосредственных инструкций, групповых ожиданий и давления необходимости отвечать. Человек может последовать за странным вопросом, вытерпеть незавершённую мысль и связать идеи, прежде чем кто-либо ещё определит задачу.

В группах одновременная генерация идей может быть ограничена блокировкой высказываний — необходимостью ждать своей очереди, пока мысль угасает, — а также тревогой из-за оценки или снижением индивидуального вклада.32 Ранние примеры также могут приводить к совместной фиксации, сужая диапазон исследуемых направлений до того, как отличительная линия мысли успеет сформироваться.35

Осознанное возвращение

Когда идея обретает достаточно чёткую форму, чтобы ею поделиться, другие люди часто становятся ценными, а порой и незаменимыми для проверки, развития и распространения. Они могут ставить под сомнение предположения, делиться знаниями, тестировать результат, предоставлять ресурсы, улучшать коммуникацию, открывать двери и защищать создателя от слепых зон. В трёх контролируемых экспериментах по брейнрайтингу чередование индивидуальных и групповых сессий породило больше идей, чем постоянное пребывание в любом одном режиме, — это свидетельствует в пользу гибкого цикла в лабораторной генерации идей, а не существования единственной универсально лучшей среды для любой творческой работы.33

Возвращение по собственному выбору может стать праздником: личная искра встречается с признанием, поддержкой и совместными усилиями. Разуму не нужно оставаться в одиночестве, чтобы сохранять оригинальность.

Дайте оригинальности достаточно уединения, чтобы сформироваться, и достаточно сообщества, чтобы развиваться, распространяться, получать поддержку и признание.
Ритм независимости и принадлежности

Ни один из этапов не должен превращаться в предписание. Уединение может стать изоляцией, а сотрудничество — конформизмом. Одни люди лучше всего думают в диалоге, другие — в тишине, а многие чередуют оба режима. Здоровая модель гибка: без стыда отстраняйтесь, когда ненаправленное мышление нуждается в защите, а затем без стыда возвращайтесь, когда нужны отношения, критика и совместное творчество.

Когда разум защищён от унижения, принуждения и постоянных прерываний, люди могут поддерживать интеллектуальное развитие друг друга, не стирая различий. Интеллект становится чем-то большим, чем личное преимущество: он превращается в способность, разделяемую через обучение, изобретательство, заботу, честные разногласия и коллективное решение проблем.

13 · Практическое применение

Выбор оценки и подготовка к ней

Начните с решения, которое необходимо улучшить. «Лучший тест» в абстрактном смысле может оказаться неподходящей оценкой для конкретного человека, вопроса или юрисдикции.

01

Определите цель

Клиническая диагностика, образовательное планирование, выявление одарённости, поддержка людей с инвалидностью, исследования и личный интерес требуют разных данных и разной степени точности.

02

Соотнесите с человеком

Уточните возраст, язык, культурный контекст, доступность для людей с сенсорными и двигательными особенностями, коммуникативные потребности, знакомство с цифровыми технологиями и релевантность нормативной выборки.

03

Соотнесите с решением

Узнайте, подтверждают ли руководство по тесту и независимые стандарты именно такую интерпретацию и нужны ли дополнительные данные.

Перед сеансом

  • Обратитесь к квалифицированному специалисту для клинической, образовательной или иной значимой интерпретации.
  • Сообщите соответствующую информацию об истории языкового развития, образовании, диагнозах, принимаемых препаратах, предоставляемых условиях и предыдущем тестировании.
  • Узнайте, какие конструкты, показатели и группы сравнения использует выбранная батарея тестов.
  • Позаботьтесь об обычном сне, питании, назначенном лечении и сенсорных средствах; не пытайтесь в последний момент «подготовиться к тесту на IQ».
  • Сообщите о необычном недомогании, боли, тревоге или прерывании, чтобы при необходимости можно было рассмотреть перенос.

Во время сеанса

Старайтесь отвечать искренне, спрашивайте, если инструкции непонятны, и сообщайте о препятствиях доступу. Не ищите утекшие задания и не репетируйте содержание защищённых тестов: это ставит под угрозу смысл результата. Обычное знакомство с головоломками — часть жизни; подготовка по защищённым заданиям меняет вывод, который можно сделать на основе балла.

После сеанса: вопросы, которые стоит задать

  • Какова была составная оценка и её доверительный интервал?
  • Какие различия в профиле надёжны, необычны и практически значимы?
  • Какие условия тестирования могли повлиять на результативность?
  • Насколько результаты согласовывались с историей и другими свидетельствами?
  • Чего этот тест не измеряет?
  • О каких решениях эти баллы могут правомерно информировать?
  • Какие задачи, поддержка или дальнейшая оценка должны последовать?
  • Когда повторное тестирование будет полезно и как будут учтены эффекты тренировки?

Личное любопытство тоже требует контекста

Надёжная оценка может дать ценное понимание себя. Воспринимайте число как одну из координат, а затем спросите, что оно помогает вам делать: выбирать подходящий уровень сложности, развивать менее сильные навыки, ответственно использовать свои сильные стороны и продолжать учиться. Погоня за незначительными различиями в баллах может заменить развитие тревогой из-за измерений.

14 · Взгляд в будущее

Более быстрое тестирование не должно означать менее убедительные доказательства

Адаптивные платформы, данные о процессе и искусственный интеллект могут улучшить измерение, но эффективность не равна валидности, а прогнозирование — пониманию.

Компьютеризированное адаптивное тестирование

Алгоритм выбирает следующий пункт из откалиброванного банка заданий на основе предыдущих ответов. Это может обеспечить сопоставимую точность при меньшем количестве заданий, но является способом проведения тестирования, а не новой формой интеллекта.

Данные о процессе

Время выполнения, исправления, изменения стратегии и последовательности ответов могут показать, как был найден способ решения. Эти сигналы требуют независимой проверки и могут привносить технологические или моторные требования.

Интерпретация с помощью ИИ

Системы могут выявлять закономерности, составлять черновики отчётов или предлагать гипотезы. Они не должны скрывать неопределённость, выдумывать диагнозы, воспроизводить предвзятость данных для обучения или заменять подотчётное профессиональное суждение.

Что ответственная инновация должна сделать видимым

  • Конструкт: что выводится по наблюдаемому поведению и каким образом.
  • Данные для обучения и нормирования: кто представлен, кого не хватает и насколько недавно были собраны данные.
  • Неопределённость: точность в зависимости от диапазона баллов, подгруппы и порога принятия решения.
  • Справедливость: функционирование заданий, доступность, дифференциальное прогнозирование и последующие ошибки.
  • Конфиденциальность: какие конфиденциальные когнитивные и поведенческие данные хранятся, связываются, сохраняются или передаются.
  • Подотчётность: кто может объяснить, оспорить и исправить значимый результат.

Большее количество поведенческих данных одновременно может дать более подробную модель и повысить риск нарушения конфиденциальности. Голос, нажатия клавиш, направление взгляда, задержки и особенности взаимодействия могут раскрывать сведения об инвалидности, состоянии здоровья или личности, выходящие за пределы заявленной цели. Поэтому минимизация данных, информированное согласие, безопасность и реальная возможность обжалования должны быть частью разработки тестов, а не прятаться в непрочитанном заключительном абзаце.

Стандарт будущего

Лучшая оценка — не та, которая выдаёт больше всего чисел. Это та, которая с достаточной точностью отвечает на важный вопрос, создаёт меньше нерелевантной нагрузки, раскрывает свои ограничения и ведёт к лучшим возможностям или поддержке.

15 · Чёткие выводы

Распространённые мифы — исправления

Большинство споров об IQ становятся яснее, если заменить абсолютное утверждение ограниченным.

Миф: IQ бессмысленен.
Исправление: хорошо валидированные тесты оценивают важные когнитивные способности и вероятностно прогнозируют значимые результаты.
Миф: IQ измеряет весь разум.
Исправление: он оценивает отдельные общие и специфические способности; для оценки творчества, ценностей, личности, эмоций и практического опыта нужны другие данные.
Миф: 120 означает, что человек на 20% умнее человека со значением 100.
Исправление: стандартизированный IQ не является шкалой отношений. Различия показывают положение результата в нормативном распределении.
Миф: результат точен.
Исправление: каждый результат содержит измерительную неопределённость и должен интерпретироваться как диапазон с учётом контекстных ограничений.
Миф: интеллект фиксирован.
Исправление: когнитивные различия могут быть стабильными, тогда как образование и поддерживающая среда всё же обеспечивают реальное развитие.
Миф: каждое повышение результата при повторном тестировании означает повышение общего интеллекта.
Исправление: практика, стратегия и снижение тревожности могут повысить баллы; широкий рост требует данных о переносе навыков, настойчивости и надёжных изменениях.
Миф: невербальное означает свободное от влияния культуры.
Исправление: невербальные форматы снижают некоторые языковые требования, но по-прежнему зависят от обучения, опыта, доступа к возможностям и знакомства с тестами.
Миф: групповые различия доказывают предвзятость.
Исправление: различия требуют исследования. Справедливость зависит от совокупности данных о заданиях, конструкте, нормах, прогнозировании и последствиях.
Миф: уважение к высокому интеллекту требует утверждать превосходство характера.
Исправление: IQ не доказывает автоматически мудрость или добродетель, но может выявить редкие когнитивные способности. Эти способности — и пожизненная работа по их развитию — могут иметь исключительное практическое значение и заслуживают серьёзного уважения.

Заключение: измеряйте то, что важно, и помогайте этому развиваться

Тестирование IQ — это не приговор и не иллюзия. Грамотно разработанная и адекватно нормированная оценка может дать полезную приблизительную оценку общих и специфических когнитивных способностей. Эти способности важны: они способствуют более быстрому обучению, глубокому пониманию, адаптивному мышлению и способности решать всё более сложные задачи.

Оценка остаётся условной. Она содержит неопределённость, отражает конкретную выборку поведения и не может охватить человека целиком. Справедливое применение требует подходящих нормативов, доступного проведения, доказательств в пользу предполагаемой интерпретации и сдержанности, когда последствия серьёзны. Дополнительные оценки должны расширять картину, не создавая видимости, будто все ценные способности представляют собой единый скрытый показатель.

Важнее всего то, что измерение должно служить развитию. Образование может укреплять когнитивные показатели; здоровье и безопасность защищают мозг; вызовы, обратная связь и практика формируют знания и навыки; уединение может дать укрытие оригинальной мысли; сообщество может помочь ей созреть и достичь мира. Цените устойчивый когнитивный рост — и подтверждённое повышение IQ, когда учтены перенос навыков, устойчивость результата, эффекты практики и ошибка измерения, — а затем используйте возросшие способности, чтобы углублять понимание, расширять возможности и улучшать жизнь.

Тщательно измеряйте интеллект, помогайте ему развиваться и защищайте людей, в которых он воплощён. Цените выдающиеся способности, обучение на протяжении всей жизни, оригинальное мышление и накопленную мудрость. Давайте развитым умам здоровье, свободу, уединение, сообщество, вызовы и уважение, которые им необходимы, — потому что, когда такой ум игнорируют или теряют, человечество может лишиться руководства, понимания и возможностей, которые никакая собственность или база данных не способны просто заменить.

Библиотека доказательств

Источники и дополнительная литература

Основные стандарты, официальные рекомендации, исторические документы и рецензируемые исследования, использованные для этого руководства.

  1. AERA, APA и NCME. Стандарты образовательного и психологического тестирования (2014).
  2. Дири, Кокс и Хилл. Генетическая вариативность, мозг и различия в интеллекте. Molecular Psychiatry (2022).
  3. Брисбер и Николя. Два устойчивых мифа о Бине и зарождении тестов интеллекта в учебниках по психологии. Collabra: Psychology (2024).
  4. Бине и Симон. Развитие интеллекта у детей (1908, французский оригинал).
  5. Ковач и Плех. Уильям Штерн: актуальность его программы «дифференциальной психологии» для современных измерений и исследований интеллекта. Journal of Intelligence (2023).
  6. Terman. Измерение интеллекта (1916).
  7. Министерство обороны США. История военного тестирования.
  8. Warne и др. Анализ Стивена Джея Гулда теста Army Beta в книге Ошибки измерения человека: искажения и заблуждения относительно новаторского теста умственных способностей. Журнал интеллекта (2019); Brigham. Тесты интеллекта для групп иммигрантов. Психологический обзор (1930).
  9. Национальный институт исследований генома человека. Евгеника и научный расизм; Snyderman и Herrnstein. Тесты интеллекта и Закон об иммиграции 1924 года (1983).
  10. Boake. От Бине—Симона до Векслера—Бельвью. Журнал клинической и экспериментальной нейропсихологии (2002).
  11. McGrew. Трёхуровневая теория когнитивных способностей Кэрролла спустя 30 лет: влияние, уточнение теории 3S-CHC, структурная репликация и расширение психометрического сетевого анализа когнитивных способностей и достижений. Журнал интеллекта (2023).
  12. Pearson Assessments. Шкала интеллекта Векслера для взрослых, пятое издание.
  13. Национальные академии. Психологическое тестирование для установления инвалидности (2015).
  14. Sackett и др. Пересмотр метааналитических оценок валидности при отборе персонала: устранение систематической сверхкоррекции из-за ограничения диапазона. Журнал прикладной психологии (2022).
  15. Ritchie и Tucker-Drob. Насколько образование повышает интеллект? Метаанализ. Психологическая наука (2018).
  16. Пичниг и Ворачек. Столетие глобального роста показателей IQ: формальный метаанализ эффекта Флинна. Перспективы психологической науки (2015).
  17. Шарфен, Петерс и Холлинг. Эффекты повторного тестирования при оценке когнитивных способностей: метаанализ. Интеллект (2018).
  18. Саймонс и др. Работают ли программы «тренировки мозга»? Психологическая наука в общественных интересах (2016).
  19. Брайт и др. Стабильность когнитивных способностей: метааналитический обзор лонгитюдных исследований. Психологический бюллетень (2024).
  20. Международная комиссия по тестированию. Рекомендации ITC по переводу и адаптации тестов (второе издание) (2017).
  21. Путник и Борнстайн. Соглашения и представление результатов при оценке инвариантности измерений. Обзор исследований развития (2016).
  22. Европейская федерация ассоциаций психологов. Модель EFPA для обзора тестов, версия 2025 года.
  23. Американская ассоциация по интеллектуальным и нарушениям развития. Определение интеллектуальной недостаточности.
  24. Мияке и др. Единство и многообразие исполнительных функций. Когнитивная психология (2000).
  25. Топлак, Уэст и Станович. Показатели исполнительных функций на основе выполнения заданий и рейтинговой оценки. Журнал детской психологии и психиатрии (2013).
  26. Свонсон и Люсье. Избирательный обзор экспериментальной литературы по динамической оценке. Обзор исследований в области образования (2001).
  27. ОЭСР. Рамочная концепция творческого мышления PISA 2022.
  28. Karwowski и др. Как результаты тестов на интеллект связаны с творческими достижениями? Метаанализ. Journal of Intelligence (2021).
  29. O’Connor и др. Измерение эмоционального интеллекта: критический обзор литературы и рекомендации для исследователей и практиков. Frontiers in Psychology (2019).
  30. MacCann и др. Эмоциональный интеллект предсказывает академическую успеваемость: метаанализ. Психологический вестник (2020).
  31. Waterhouse. Множественный интеллект, эффект Моцарта и эмоциональный интеллект: критический обзор. Педагогическая психология (2006).
  32. Mullen, Johnson и Salas. Снижение продуктивности в группах мозгового штурма: метааналитический обзор. Базовая и прикладная социальная психология (1991).
  33. Korde и Paulus. Чередование индивидуальной и групповой генерации идей: поиск неуловимой синергии. Журнал экспериментальной социальной психологии (2017).
  34. Flore и Wicherts. Влияет ли угроза стереотипа на результаты девочек в областях, связанных со стереотипами? Метаанализ. Журнал школьной психологии (2015).
  35. Kohn и Smith. Коллективная фиксация: влияние идей других людей на мозговой штурм. Прикладная когнитивная психология (2011).

Примечание об образовании и оценивании: Эта статья содержит общую информацию, а не индивидуальный диагноз, интерпретацию результатов, юридическое заключение или замену оценки квалифицированным психологом либо другим специалистом с соответствующей квалификацией. Выбор теста, условия его проведения, правила определения права на участие и юридические требования зависят от места проведения и цели.

Продолжить изучение
Вернуться к центру «Интеллект без границ»
Вернуться к блогу