Intelekto Matavimas - www.Kristalai.eu

Измерение интеллекта

Освобождённый интеллект · Измерение

Измеряйте интеллект, не сужая представление о разуме

Интеллект важен. Более развитые способности к рассуждению, память, знания и способность к обучению могут помочь людям больше понимать, быстрее учиться, решать более сложные проблемы и самостоятельнее ориентироваться в жизни. Хорошие тесты IQ могут измерять важные составляющие этой способности. Наиболее полезными они становятся, когда мы рассматриваем их как тщательно составленные оценки - а не как идентичность, приговор или предел.

Что измеряет IQ Баллы и процентили Надёжность и валидность Корректная интерпретация Дополнительные доказательства Когнитивное развитие Уважение к выдающимся умам
Главная мысль

Полезный сигнал, интерпретируемый в контексте

Результат теста интеллекта - это пример выполнения отобранных когнитивных заданий в определённых условиях. Хорошо разработанные батареи тестов могут дать информацию о более широких способностях, возможных относительных сильных сторонах и потребностях в поддержке, а также помочь планировать обучение или дальнейшее клиническое обследование. Их баллы имеют смысл именно потому, что их утверждения обладают чёткими и проверяемыми границами.1

Правильный вопрос звучит не так: «Важен ли IQ или важен весь человек?» Важны оба аспекта. Когнитивные способности влияют на обучение и многие жизненные результаты, а достоинство, моральную ценность, цель и всё богатство разума невозможно свести к одному баллу.

✦

Выдающийся интеллект может иметь выдающееся значение

Более высокий валидный балл - весомое доказательство того, что человек лучше справляется с теми способностями, которые измеряет тест. Это различие важно, и его не следует преуменьшать. В сочетании с любознательностью, дисциплиной, знаниями и мудростью выдающиеся когнитивные способности могут сделать человека необычайно важным для других людей и общества - помочь заметить скрытые связи, решать сложные проблемы, сохранять знания и направлять работу, которая иначе, возможно, никогда не была бы выполнена.

Один балл не доказывает мудрость, характер или достижения, а основное человеческое достоинство принадлежит всем в равной мере. Однако равное достоинство не требует делать вид, будто все способности или вклады одинаковы. Редкий интеллект и с трудом развитое интеллектуальное мастерство заслуживают настоящего признания, защиты и уважения.

Как читать знакомую шкалу IQ

Многие современные составные баллы нормируются так, чтобы среднее значение составляло 100, а стандартное отклонение - 15. Иллюстрация ниже показывает приблизительные положения в нормальном распределении; названия и интерпретации различаются в зависимости от теста, версии, возраста и нормативной группы.

7085100115130
Важно: в этой часто используемой шкале значения 85 и 115 находятся примерно на одно стандартное отклонение ниже и выше среднего. 115 не означает, что человек «на 15 % умнее» человека с результатом 100: IQ - это стандартизированный балл, похожий на балл по интервальной шкале, а не относительная шкала. Процентиль показывает относительное положение - а не процент правильно отвеченных вопросов, - и каждый наблюдаемый балл имеет неопределённость измерения.
01

Основанный на нормах

Баллы сравнивают результат с подходящей стандартизационной выборкой, обычно с людьми примерно того же возраста. Они напрямую не подсчитывают фиксированное «количество интеллекта».

02

Оценка, а не приговор

Надёжность никогда не бывает идеальной. В отчёте следует указывать доверительный интервал и объяснять, превышают ли небольшие различия ожидаемую погрешность измерения.

03

Профиль может дать важный контекст

Надёжные различия между более широкими областями могут предложить гипотезы об относительных сильных сторонах и потребностях в поддержке. Колебания результатов отдельных субтестов не следует считать диагностическими.

01 · Значение

Что на самом деле измеряет IQ-тест

Батарея IQ-тестов напрямую не заглядывает в разум. Она использует стандартизированные задания для выявления поведения, последовательно оценивает результат и проверяет, подтверждает ли получившаяся модель конкретную интерпретацию.

Большинство комплексных тестов интеллекта охватывает несколько когнитивных областей: рассуждение с новой информацией, приобретённые вербальные знания, зрительно-пространственный анализ, рабочую память и эффективность обработки информации. Результаты этих заданий положительно коррелируют между собой, поэтому более широкий составной балл может обобщать значимое общее измерение когнитивного функционирования.2

Этот составной балл ценен тем, что сжимает информацию. По той же причине он неполон. Мотивация, любознательность, креативность, эмоциональные навыки, практические знания, настойчивость, здоровье, ценности и возможности могут влиять на то, чего человек добивается благодаря своим способностям, но не тождественны общим когнитивным способностям.

Сначала конструкт, потом число

Для каждого балла нужно предложение, начинающееся так: «Этот результат даёт основания судить о…» В конце следует указать конструкт, популяцию, условия и предполагаемое использование. Если предложение превращается в «это число говорит нам всё о человеке», интерпретация уже вышла за пределы доказательств.

Краткий ключ к терминам: конструкт – способность, о которой делается вывод; батарея – набор заданий; субтест – пример более узкого навыка; индекс – объединение нескольких связанных субтестов; составной балл – краткое выражение более широкой модели; а нормативная группа – референтная выборка, по которой интерпретируется положение человека.

Четыре термина, помогающие избежать распространённых недоразумений
Термин Что он означает Чего он не означает
Исходный балл Количество правильно выполненных заданий или набранных баллов до преобразования по нормативам. Показатель, который можно напрямую сравнивать для разных возрастов, версий или тестов.
Стандартный балл Преобразованный балл, показывающий положение в референсном распределении. Процент всего интеллекта человека.
Процентиль Приблизительная доля нормативной группы, получившая такой же или более низкий результат. Процент правильных ответов или процент, на который один человек «умнее» другого.
Доверительный интервал Интервал, признающий неопределённость наблюдаемого балла. Гарантия того, что скрытый «истинный балл» навсегда зафиксирован внутри этого интервала.
02 · Качество теста

Как надёжный тест завоёвывает авторитет

Отполированный интерфейс, сложные головоломки или ярлык «на основе ИИ» не делают интеллектуальный тест валидным. Доверие должно быть заслужено документированными доказательствами.

Чёткий конструкт

Разработчик определяет, какие способности должен измерять тест, что он намеренно оставляет за пределами и какие интерпретации обоснованы.

Стандартизированное проведение

Инструкции, время, подсказки, правила оценивания и условия тестирования контролируются, чтобы результаты оставались сопоставимыми.

Соответствующие нормы

Достаточно большая и подходящая выборка даёт точку отсчёта для интерпретации. Устаревшие или плохо соответствующие нормам могут исказить положение человека.

Надёжность

Баллы достаточно стабильны между заданиями, формами, оценщиками или сеансами тестирования для предполагаемого решения. Чем важнее решение, тем выше требуемая точность.

Доказательства валидности

Содержание, процессы ответа, внутренняя структура, связи с другими переменными и последствия обосновывают предлагаемую интерпретацию и использование.

Справедливость и доступность

Разработчики изучают препятствия, функционирование в разных группах и адаптации, а затем чётко указывают, где доказательства слабы или использование неуместно.

Надёжность необходима - но её недостаточно

Весы, которые всегда показывают на пять килограммов больше, надёжны, но неточны. Так и когнитивный тест может последовательно ранжировать результаты, не обосновывая каждую интерпретацию, которую из них делают. Профессиональные стандарты оценивают валидность как совокупность доказательств, поддерживающих конкретную интерпретацию для конкретного использования, а не как постоянный ярлык, прикреплённый к тесту.1

Стандартная ошибка и доверительные интервалы

Поскольку тест использует выборку поведения, наблюдаемый балл содержит неопределённость. Доверительный интервал выражает эту неточность с учётом надёжности теста и шкалы баллов. Интервал не охватывает все возможные источники погрешности - например, плохой сон, неправильное понимание инструкций, языковое несоответствие или необычный день тестирования, - однако он честнее, чем представление одного числа как абсолютно точного.

Упрощённый пример

В классической теории тестов стандартную ошибку измерения можно проиллюстрировать формулой SD × √(1 − надёжность). Для шкалы со стандартным отклонением 15 и надёжностью 0,95 получаем примерно 3,35 балла. В этом упрощённом примере наблюдаемый результат 120 имел бы приблизительный 95%-ный интервал 113–127.

Почему важно слово «упрощённый»

Реальная интерпретация должна использовать приведённые в руководстве оценки погрешности, определённые с учётом возраста, балла и разрешения. Точность может различаться в разных точках шкалы, особенно вблизи крайних результатов. Баллы изменений и различий также имеют собственную погрешность и не могут оцениваться только по надёжности каждого отдельного балла.1

Когда два индексных балла различаются, специалист должен спросить больше, чем только о том, достигает ли разница статистического порога. Как часто разница такого размера встречается в нормативной выборке? Повторяется ли она в сходных заданиях и в истории? Связана ли она с вопросом оценки? Иначе профиль, выглядящий драматично, может превратиться в историю, созданную совершенно обычными колебаниями.

03 · История

Инструмент для поддержки, история прогресса - и предупреждение о власти

Тестирование интеллекта не возникло сразу в завершённом виде. В его истории есть гуманные образовательные цели, значительные технические достижения, необоснованные выводы и принудительное злоупотребление. Понимание всех четырёх аспектов помогает лучше измерять сегодня.

1905–1908Бине–Симон

Предшественник из 30 заданий превращается в более подробную шкалу, распределённую по возрасту и предназначенную для выявления детей, которым может потребоваться иное обучение.

1912Коэффициент Стерна

Уильям Стерн предлагает «коэффициент интеллекта»: оценочный умственный возраст делится на хронологический возраст.

1916Стэнфордская редакция

Льюис Терман адаптирует и расширяет шкалу для Соединённых Штатов и популяризирует относительный IQ, выраженный целыми числами.

С 1939 годаБатареи Векслера

Тестирование взрослых объединяет вербальные задания и задания на выполнение, а также развивает нормированные по возрасту стандартные баллы отклонения.

СегодняПрофили + неопределённость

Современные батареи тестов предоставляют совокупные и профильные баллы, рассчитанные по установленным нормам, вместе с данными о надёжности и валидности.

Бине и Симон: текущий результат, а не вечная судьба

В 1905 году Альфред Бине и Теодор Симон опубликовали влиятельного предшественника из 30 заданий; их более подробная редакция 1908 года распределила задания по возрастным уровням и уже больше напоминала практическую шкалу интеллекта, описанную в более поздних учебниках. Эта работа выросла из французских дискуссий о том, как выявлять и обучать детей, которым трудно учиться в обычных классах. Задания охватывали такие способности, как понимание, память и принятие решений, чтобы более системно распознавать текущие потребности.34

Это ещё не был современный тест IQ, и в нём не использовался коэффициент, предложенный позднее Стерном. Бине описывал шкалу как практическую иерархию, а не как буквальное измерение наподобие физической длины, и выступал против идеи, что низкий результат доказывает наличие неизменной величины. Эту осторожность не следует романтизировать, превращая её в утверждение, будто любая способность может расти без ограничений. Его непреходящая ценность проще: результат должен помогать подобрать поддержку, а не становиться приговором.

Стерн, Терман и число, названное IQ

В 1912 году немецкий психолог Вильям Штерн предложил термин Intelligenzquotient: оценочный умственный возраст делится на хронологический возраст. Редакция Стэнфордской шкалы, подготовленная Льюисом Терманом в 1916 году, переняла этот коэффициент, умножила его на 100 и помогла популяризировать «IQ» в образовании США.56 Эти ранние результаты были отношением IQ. Это ещё не были используемые сегодня отклоняющиеся баллы, которые размещают результат человека в нормативном распределении той же возрастной группы.

Массовое тестирование и опасность выхода за пределы данных

Во время Первой мировой войны в Army Alpha проводилось групповое тестирование англоязычных грамотных новобранцев, а преимущественно визуальный Army Beta предназначался для новобранцев с ограниченной грамотностью или слабыми навыками английского языка. Эта программа показала, что психологические тесты можно проводить в огромных масштабах и использовать для практической классификации.7

Исторический провал начался тогда, когда на результаты, на которые повлияли язык, школьное образование, аккультурация, отбор и условия тестирования, стали распространять утверждения о врождённой расовой или национальной иерархии. Ярким примером стала интерпретация Карлом Бригамом данных Army в 1923 году; к 1930 году он сам отверг основания этих сравнений. Расовые интерпретации тестов придали вид научного авторитета более широкой евгенической и нативистской культуре, хотя утверждения о том, что тесты Army непосредственно определили Закон США об иммиграции 1924 года, преувеличивают архивные свидетельства.89

Урок - точность, права и самостоятельность

Евгеника ранжировала человеческие жизни и лишала людей самостоятельности посредством сегрегации, изоляции и репродуктивного принуждения. Поддержка людей в укреплении когнитивных функций с помощью образования, питания, медицинской помощи, безопасности и добровольно выбранных практик действует противоположным образом - она расширяет самостоятельность. Интеллектуальный рост можно отмечать, одновременно уважая равенство людей, если способности развиваются и используются во благо, а не смешиваются с правом на достоинство.

Векслер и современный профиль, нормированный по возрасту

Шкала Векслера-Белвью, созданная Дэвидом Векслером в 1939 году, предназначалась для клинического использования у взрослых. Она объединила вербальные задания и задания на выполнение и сравнивала взрослых с людьми того же возраста, помогая этой области отойти от буквального соотношения умственного возраста. В 1949 году появилась WISC для детей, а в 1955 году - первая WAIS.10 Более поздние батареи всё чаще сочетали широкий составной балл с интерпретируемыми баллами по областям - эта архитектура остаётся важной и сегодня.

04 · Модели

Как общие и специфические способности сочетаются друг с другом

Широко используемый психометрический подход является иерархическим: когнитивные задачи имеют нечто общее, однако для разных задач также требуются более специфические способности.

Общий фактор, g

Люди, которые хорошо справляются с одной достаточно сложной когнитивной задачей, в среднем склонны хорошо справляться и с другими. Факторный анализ обобщает эту положительную модель результатов общим фактором, обычно называемым g. Это один из наиболее многократно подтверждённых результатов в психологии.2

g являются статистической закономерностью, а не крошечным образованием в одном участке мозга, и теории расходятся во мнениях относительно механизмов, из которых она возникает. Для её полезности не требуется притворяться, будто эти механизмы полностью изучены.

Широкие и узкие способности

Иерархические системы, такие как Cattell–Horn–Carroll, организуют результат на общий уровень, широкие способности и более узкие навыки. Текучий интеллект и приобретённые знания являются яркими примерами; другие области могут включать визуальную обработку, кратковременную рабочую память, беглость воспроизведения и скорость обработки.11

CHC лучше всего понимать как таксономию, основанную на психометрических доказательствах, а не как утверждение, что каждая батарея идеально реализует одну и ту же карту.

Составной балл отвечает на вопрос: «Какая широкая модель наиболее обоснована?» Профиль отвечает на вопрос: «Есть ли какие-либо различия между широкими областями, которые достаточно надёжны, редки и подтверждены другими данными, чтобы обосновать гипотезу?»
Два уровня интерпретации, а не конкурирующие определения

Специфическим баллам стоит уделять внимание, когда они достаточно надёжны, основаны более чем на одном задании и дают важную дополнительную информацию за пределами составного балла для конкретного применения. Меньше внимания они заслуживают, когда предполагаемый подъём или спад зависит от одного короткого субтеста. Широкие баллы часто надёжнее; более узкие могут направлять дальнейшую оценку, однако их образовательную или клиническую полезность не следует считать само собой разумеющейся.

05 · Современные батареи

Что могут оценивать современные тесты интеллекта

Батареи различаются по возрасту, назначению и теории. Представленные ниже области иллюстрируют распространённые направления оценки, а не универсальную структуру, характерную для каждого теста.

Типичные области и вопросы, на которые они помогают ответить
Область Типичное требование Осторожность интерпретации
Текучий интеллект Выявлять правила, предвидеть связи и решать незнакомые задачи. Предыдущий опыт работы с форматами головоломок, стратегия и обучение по-прежнему важны.
Приобретённые знания / вербальное понимание Использовать словарный запас, понятия и культурно передаваемые знания. Язык, школьное образование и возможность учиться являются неотъемлемой частью результата.
Визуально-пространственная обработка Анализировать, преобразовывать или составлять пространственные модели. Зрение, моторная реакция и опыт работы с диаграммами могут повлиять на результат.
Рабочая память В течение короткого времени удерживать информацию и манипулировать ею. Внимание, слух, тревожность и стратегия могут повлиять на краткий пример выполнения.
Скорость обработки В условиях ограничения времени точно и эффективно выполнять простые зрительные решения. Моторная скорость, доступность зрительного восприятия и осторожный стиль ответов могут повлиять на балл.
Долговременное запоминание / беглость Эффективно воспроизводить выученные ассоциации или генерировать информацию. Знания, язык и практика, связанная с конкретным заданием, влияют на результат.

Примеры профессионально разработанных инструментов - Stanford–Binet, шкалы Векслера, когнитивная батарея Woodcock–Johnson, батареи Кауфмана и матрицы Равена. Одного названия бренда недостаточно. Важны соответствующее издание, возрастной диапазон, язык, нормы, квалификация специалиста и цель использования. Например, текущая батарея Векслера для взрослых в Соединённых Штатах - WAIS–5, однако доступность и утверждённые версии различаются в разных странах.12

Скрининг - не комплексное оценивание

Краткий скрининговый инструмент может показать, стоит ли проводить более подробное оценивание. Невербальное задание на матрицы может оценивать абстрактное мышление, снижая потребность в языке. Онлайн-тест может быть интересным или образовательным. Однако ни один из них автоматически не обладает такой же широтой охвата, контролируемыми условиями, защищёнными заданиями, репрезентативными нормами и доказательствами для интерпретации, как профессионально проводимая батарея тестов.

06 · Интерпретация

Как читать отчёт о когнитивном оценивании

Ответственный отчёт превращает числа в ограниченные выводы, проверяет конкурирующие объяснения и связывает результаты с полезными действиями.

Начните с вопроса оценивания

  • Почему было запрошено оценивание?
  • Какой тест и какое издание использовались и подходят ли они для данного случая?
  • Кто входил в нормативную группу и когда были собраны нормы?
  • Были ли проведение и оценивание стандартизированы?
  • Отражало ли выполнение обычное функционирование человека?

Затем переходите от общего к конкретному

  • Суммарный балл и доверительный интервал
  • Надёжные и значимые различия между индексами
  • Согласующиеся субтесты - не отдельные пики или провалы
  • Наблюдения за поведением и условия тестирования
  • Соответствие истории обучения, работы и повседневной жизни

Общий балл и профиль индексов

Широкий суммарный балл часто является наиболее надёжным обобщением общего результата. Большие и надёжные различия между областями в совокупности могут дать клинически важную информацию, однако рассеянный профиль сам по себе не отменяет суммарный балл. Неравномерный профиль автоматически не доказывает наличие конкретного нарушения, а самый высокий балл не обязательно является «истинным IQ» человека. Оценивающий специалист должен определить, являются ли различия статистически надёжными, достаточно редкими, чтобы заслуживать внимания, и подтверждаются ли независимыми свидетельствами.

Результат зависит от ситуации

Недостаток сна, боль, острое заболевание, тревога, депрессия, воздействие лекарств, нарушения слуха или зрения, требования к моторике, незнакомый язык, прерванное обучение, слабая вовлечённость и непонятые инструкции могут повлиять на наблюдаемый результат. Некоторые из этих условий являются частью реального функционирования, которое стремятся исследовать; другие представляют собой несущественные препятствия. При интерпретации их следует различать, а не автоматически добавлять или вычитать баллы.

Повторное тестирование и влияние практики

Более высокий балл при повторном тестировании может отражать запомнившийся формат, новые стратегии, снижение тревожности или пересекающиеся задания. Эти эффекты практики означают реальное улучшение выполнения теста, но не обязательно означают такой же рост широких базовых способностей. Величина зависит от интервала, возраста, теста и предыдущих попыток; помогают альтернативные формы и надлежащие рекомендации по повторному тестированию.17

Просите о полезной неопределённости

Хорошее объяснение звучит так: «Результат в этой области был оценён в этом диапазоне; вероятно, он имеет смысл, поскольку эти задания согласуются друг с другом и с историей человека. На него могли повлиять эти условия. Вот что этот результат предлагает попробовать дальше».

07 · Прогностическая сила

Что прогнозирует IQ - и чего он не прогнозирует

Общие когнитивные способности имеют реальные последствия. Они прогнозируют вероятности в группах, а не заранее предопределённые биографии конкретных людей.

Обучение

Рассуждение, знания и память помогают легче понимать обучение, связывать идеи и приобретать сложные навыки. Когнитивные способности значимо связаны с результатами обучения.2

Сложная работа

Общие умственные способности прогнозируют результаты работы, хотя обновлённые метааналитические оценки более умеренны, чем некоторые прежние утверждения.14

Ориентирование в жизни

В популяциях более высокий когнитивный результат связан с более высоким уровнем образования, более сложной работой и некоторыми показателями здоровья и долголетия. Эти связи возникают через множество индивидуальных и социальных путей; они не определяют будущее человека.2

Корреляция - не личное пророчество

Корреляция описывает, как переменные склонны изменяться вместе в популяции. Она не говорит о том, что сам по себе балл вызывает результат или что все люди с одинаковым баллом будут жить одинаково. Качество образования, здоровье, семейные ресурсы, личность, интересы, дискриминация, мотивация, отношения, ценности и случайность влияют и на возникающие возможности, и на то, как используются способности.

Даже сильная связь оставляет огромный простор для индивидуальных различий. С другой стороны, фразу «IQ - это не всё» нельзя искажать до «IQ ничего не значит». Способности, помогающие понимать, рассуждать и учиться, стоит беречь, развивать и отмечать.

Выводы должны оставаться соразмерными доказательствам
Доказательства могут обосновать Одни лишь доказательства не могут обосновать
Оценку выбранных общих и специфических для области когнитивных способностей. Исчерпывающее описание сознания, личности, мудрости или креативности.
Вероятностные прогнозы важных результатов для популяций, в которых этот инструмент валидирован. Точные прогнозы будущего одного человека.
Выявление некоторых сильных сторон, потребностей или несоответствий в обучении. Автоматическую диагностику или определение места обучения без других доказательств.
Доказательства изменений с учётом метода, норм, неопределённости и эффекта повторного тестирования. Утверждение, что каждое изменение балла означает широкий интеллектуальный рост - или что рост невозможен.
Основание для предоставления вызова, возможностей, признания или целенаправленной поддержки — и для защиты редкой способности от растраты или ненужного вреда. Исчерпывающий рейтинг человеческого достоинства или основных прав; его психометрический балл этого не предоставляет.
08 · Справедливость

Культура, язык, инвалидность и доступность

Справедливость — не декоративная финальная проверка. Она является частью вопроса о том, валидна ли предлагаемая интерпретация балла для этого человека, популяции и цели.

Ни одна оценка не свободна от влияния культуры. Язык, образование, опыт тестирования, визуальные конвенции, доступность технологий, требования к скорости, мотивация и отношения с авторитетом могут влиять на результат. Это не означает, что каждое различие между группами является «предвзятостью», как и само различие между группами не доказывает ни предвзятость, ни различия во врождённых способностях. Эмпирический вопрос заключается в том, искажают ли несущественные препятствия в значительной мере конструкт, который должен измерять тест.

Социальный контекст может влиять на результат — однако величина влияния не универсальна

Беспокойство о подтверждении негативного стереотипа своей группы иногда может отвлекать внимание или менять вовлечённость во время тестирования. Это явление называется угрозой стереотипа. Метаанализ математических, естественно-научных и пространственных заданий среди девочек младше 18 лет выявил небольшой средний эффект, но также серьёзные признаки систематической ошибки публикаций; этот результат нельзя превращать в одно универсальное объяснение каждой разницы между группами или в различиях баллов.34 Практический вывод шире: уважительное проведение, психологическая безопасность и справедливая возможность понять задание повышают качество доказательств для всех.

Справедливость необходимо изучать на нескольких уровнях
Уровень Вопрос
Доступность и проведение Может ли человек воспринять, понять и выполнить задание без несущественных языковых, сенсорных, моторных или технологических препятствий?
Задание Имеют ли люди из разных групп с одинаковой измеряемой способностью разную вероятность правильно ответить на конкретное задание?
Шкала / конструкт Работает ли базовая структура достаточно сходным образом в разных группах, чтобы предполагаемое сравнение было обоснованным?
Нормы Является ли референтная выборка подходящей, актуальной, достаточно репрезентативной и прозрачно описанной?
Решение / результат Прогнозирует ли балл важные критерии и классифицирует ли людей с приемлемой точностью, в том числе в случаях вблизи пороговых значений?

Дифференциальное функционирование задания — это сигнал для дальнейшего изучения

Дифференциальное функционирование задания (DIF) возникает, когда люди из разных групп с одинаково измеряемой способностью всё же имеют разную вероятность ответить на задание определённым образом. DIF автоматически не доказывает предвзятость: специалисты оценивают его величину, содержание, возможную причину и влияние на общий балл. Автоматическое исключение каждого отмеченного задания также может нарушить охват содержания.

Инвариантность измерений задаётся вопросом, означают ли сравнения одно и то же

Анализ инвариантности исследует, действуют ли для факторной структуры теста, взаимосвязей и уровней баллов в разных группах достаточно похожие правила. Разные уровни инвариантности обосновывают разные утверждения; доказательств, достаточных для сравнения взаимосвязей, может быть недостаточно для сравнения средних значений групп. Инвариантность — это ценное основанное на модели доказательство, а не доказательство того, что исчезла каждая социальная или измерительная проблема.21

Перевод — не то же самое, что адаптация

Переведённое оценивание должно сохранять больше, чем слова. Значение конструкта, инструкции, примеры, графика, форматы ответов, оценивание, нормы и проведение должны быть культурно и эмпирически пересмотрены. Обратный перевод может помочь выявить расхождения, но сам по себе не доказывает эквивалентность. Руководство International Test Commission рекомендует междисциплинарную компетентность, пилотные исследования и доказательства на уровнях задания, метода и конструкта.20

«Невербальный» означает меньшую потребность в языке, а не нейтральный контекст

Такие задания, как рассуждение по матрицам, могут уменьшить зависимость от словарного запаса и приобретённых вербальных знаний. Однако их инструкции, абстрактные визуальные условности, скорость, моторная реакция и знакомство с головоломками всё равно отражают опыт. Для них нужны такие же специфичные для конкретной популяции доказательства надёжности, валидности, нормирования и справедливости, как и для вербальных показателей.

Адаптация

Изменение, предназначенное для устранения препятствия, не связанного с измеряемым конструктом, и сохранения значения балла. Оно должно быть индивидуализированным, документированным и обоснованным доказательствами.

Модификация

Изменение, которое меняет целевой конструкт или стандартизированное сравнение. Оно может быть гуманным и полезным, однако полученный балл может быть несопоставим с исходными нормами.

Дополнительное время может сохранить сопоставимость, когда скорость не является частью измеряемого конструкта; когда именно скорость обработки является измеряемым конструктом, дополнительное время может изменить значение балла, а стандартные нормы времени могут стать неприменимыми. Такая же осторожность нужна в отношении переводчиков, чтецов, помощников при письме, альтернативных интерфейсов и упрощённых инструкций. Единообразное проведение не всегда справедливо; изменённое проведение не всегда валидно.22

Для справедливости нужны и знания сообщества, и психометрические доказательства

Консультации с учителями, семьями и членами сообщества могут помочь заметить недоступные формулировки, отсутствующие местные знания или вредные предположения, которые разработчики, находящиеся далеко от пользователей, не замечают. Такая информация должна порождать гипотезы для документируемых исследований доступности, стандартизации, надёжности, валидности и результатов; сама по себе она не доказывает справедливость.120

09 · Решения

Чем серьёзнее последствия, тем надёжнее должны быть меры защиты

Один и тот же балл может быть достаточным для изучения моделей групп, но слишком неточным для принятия решений об образовании, диагнозе, работе или доступе к услугам отдельного человека.

Психологическое тестирование - это одна из частей оценки. Важный вывод должен объединять вопрос оценки, личную и историю развития, наблюдаемое поведение, значимые документы и другие измерения, не позволяя одному числу молча превратиться в основу всего решения.13

1

Используйте несколько источников

Сопоставляйте когнитивные результаты с важными данными о достижениях, анамнезе, наблюдении, интервью, образцах работ или адаптивном функционировании.

2

Уважайте неопределённость

Оценивайте доверительные интервалы, надёжность различий и ошибку классификации вблизи любого порога.

3

Проверьте уместность

Подтвердите язык, нормы, доступность, компетентность специалиста и доказательства валидности для данной популяции и цели использования.

4

Создайте путь вперёд

Результат должен вести к подходящему вызову, поддержке, обучению или дальнейшему исследованию - а не в тупик с ярлыком.

Интеллектуальная недостаточность не диагностируется только по IQ

Современные определения требуют наличия значительных ограничений как в интеллектуальном функционировании, так и в адаптивном поведении, возникших в период развития. Адаптивное поведение включает концептуальные, социальные и практические навыки, используемые в повседневной жизни. Важны также культура, язык, ожидания сообщества, сильные стороны и потребность в поддержке.23 Балл около 70 может быть важной частью доказательств; он не является самостоятельным диагнозом.

Для выявления одарённости и расширенных возможностей также необходимы сходящиеся доказательства

Высокие баллы по когнитивным тестам могут выявлять исключительные способности к рассуждению и обучению, которым необходимы сложные задачи. Однако строгое применение единственного порога может не выявить учащихся, чей совокупный балл снижают язык, инвалидность, образовательные возможности или неравномерный профиль. Несколько измерений могут улучшить и выявление, и планирование: баллы по отдельным областям, достижения, портфолио, свидетельства учителей, скорость обучения и продемонстрированная творческая работа могут иметь значение в зависимости от целей конкретной программы.

Отбор и работа

Когда когнитивные тесты используются при отборе сотрудников, измеряемые способности должны быть чётко связаны с работой, процедуры должны соответствовать применимому законодательству, а негативное воздействие - изучаться. Прогностическая корреляция на уровне группы не освобождает организацию от обеспечения доступности, справедливости, конфиденциальности, прозрачности или проверки человеком.

Не позволяйте пограничному числу выдавать себя за закон природы

Административные пороги - это решения людей, применяемые к неопределённым измерениям. Вблизи порога небольшие изменения состояния здоровья, норм, формата теста или погрешности измерения могут изменить категорию. Чем ближе балл к значимой границе, тем важнее становятся дополнительные доказательства и пересмотр.

10 · Более широкая панель показателей

Дополнительные оценки отвечают на разные вопросы

Ответ на неполное измерение - не ещё более расплывчатый «балл всего человека». Ответ - целенаправленный набор измерений, каждое из которых используется для того конструкта, который оно может обоснованно осветить.

Сохраняйте разные показатели раздельно

Разные виды доказательств должны оставаться разными. Когнитивные способности, учебные достижения, исполнительные функции, адаптивное поведение, креативность, эмоциональные навыки и продемонстрированная работа не являются взаимозаменяемыми составляющими, которые следует усреднять в одно большое число. Панель показателей сохраняет значение каждого результата – и раскрывает ценностные решения, лежащие в основе окончательного выбора.

Выберите метод, соответствующий вопросу
Метод Лучший вопрос Важное ограничение
Оценка учебных достижений Какие знания или навыки этот человек приобрёл в чтении, математике, естественных науках или другой области? Отражает учебную программу, инструкции, язык и возможность учиться, а не «чистую» способность.
Задания и оценочные шкалы исполнительных функций Как человек тормозит реакцию, переключается, удерживает цель и обрабатывает рабочую информацию в заданиях или повседневной жизни? Краткие лабораторные задания и оценки в реальной жизни часто охватывают разные аспекты и не должны считаться равноценными.25
Шкалы адаптивного поведения Насколько самостоятельно и эффективно человек использует концептуальные, социальные и практические навыки в повседневной жизни? Оценки зависят от возможностей, контекста, ожиданий и информантов; полезно использовать несколько источников.
Динамическое оценивание Как меняется результат после получения подсказок, обучения или структурированной поддержки? Проведение занимает больше времени и является менее единообразным; улучшение может быть специфичным для задания и зависеть от оценщика.26
Оценка креативности Может ли человек в определённой области генерировать, оценивать и совершенствовать оригинальные и эффективные идеи? Задания на дивергентное мышление дают пример творческого потенциала, а не отражают всю творческую жизнь или будущие достижения.
Показатели эмоциональных способностей Насколько хорошо человек воспринимает, понимает или регулирует эмоциональную информацию – или как он описывает свои типичные эмоциональные тенденции? Тесты способностей, шкалы самооценки личностных черт и смешанные модели «EQ» измеряют разные конструкты.
Портфолио и примеры работ Что человек фактически написал, спроектировал, создал, выполнил или решил за определённый период? На результат могут влиять отбор, консультирование, ресурсы и решения оценщика; помогают общие критерии и несколько примеров.

Исполнительные функции: результаты выполнения заданий и повседневная саморегуляция

Исполнительные функции включают отдельные, но взаимосвязанные аспекты целенаправленного контроля, которые часто описываются через торможение, переключение и обновление рабочей памяти. Задания на выполнение могут показывать обработку информации в контролируемых условиях; самооценки, оценки родителей или учителей могут показывать успешность повседневного достижения целей. Небольшое совпадение между этими методами означает, что расхождение информативно, а не обязательно является ошибкой: методы могут отбирать примеры разных уровней поведения.2425

Динамическое оценивание: наблюдайте за обучением, а не только за исходной точкой

Процедуры «тест - обучение - повторный тест» и постепенные подсказки исследуют, как ученик реагирует на помощь. Это может выявить стратегии, полезные виды поддержки и гибкость обучения, которые статичный балл не показывает. Это особенно полезно, когда предыдущие возможности, язык или обучение затрудняют интерпретацию. Доказательства различаются в зависимости от метода и популяции, поэтому динамическое оценивание дополняет стандартизированные данные, а не устраняет предвзятость.

Творчество: оригинальность вместе с эффективностью

Творчество - это не просто множество необычных ответов. В серьезном оценивании идеи также должны быть полезными, эффективными или подходящими для конкретной области. Можно сочетать открытые задания, реальные продукты, портфолио, экспертные оценки и историю творческой деятельности. Когнитивные способности и творческие достижения положительно связаны, но далеко не идентичны - именно поэтому оба показателя могут предоставить дополнительную информацию.2728

Эмоциональный интеллект: назовите конкретную модель

Эмоциональный интеллект как способность

Задания на выполнение, предназначенные для оценки способности воспринимать, использовать, понимать или контролировать эмоциональную информацию.

Эмоциональный интеллект как черта

Основанные на самооценке типичные тенденции и самовосприятие в эмоциональной сфере.

Смешанные модели

Более широкие сочетания способностей, личностных черт, мотивации и социального поведения, часто рекламируемые под единым ярлыком EQ.

Эти семейства моделей не следует сравнивать так, будто они представляют собой одну шкалу. Эмоциональные навыки могут способствовать отношениям, обучению и результатам, тогда как когнитивные способности измеряют нечто иное. Доказательства указывают на небольшую связь между показателями эмоционального интеллекта и академическими результатами, а дополнительная прогностическая ценность сверх когнитивных способностей и личностных черт зависит от используемого инструмента.2930

Теория множественного интеллекта: гуманная подсказка, но не валидированная диагностическая карта

Система Говарда Гарднера побудила педагогов замечать музыкальные, телесные, межличностные, пространственные и другие способности, которые узкая классная рутина слишком часто игнорирует. Это образовательное послание может быть ценным. Однако доказательства не подтверждают предложенные виды интеллекта как независимые психометрические системы, а популярные онлайн-«тесты множественного интеллекта» не должны загонять детей в рамки ярлыков стилей обучения. Используйте эту систему для расширения возможностей, а не для замены валидированного когнитивного или навыкового оценивания.31

IQ оценивает широкую и полезную модель когнитивной деятельности. Достижения показывают освоенное мастерство; показатели исполнительных функций - контроль; адаптивные шкалы - повседневное функционирование; динамическое оценивание - реакцию на обучение; показатели творчества и эмоций - другие способности; портфолио - то, что человек действительно создал или сделал.
Ни один результат не является полным портретом человека
11 · Рост

Могут ли интеллект - и IQ - расти?

Да - но это разные утверждения. Когнитивные способности могут развиваться, а нормированный по возрасту IQ может меняться. Чтобы показать устойчивый широкий рост, нужны доказательства, выходящие за рамки созревания, погрешности измерения, изменившихся норм или эффекта знакомого теста.

↑

Рост заслуживает празднования

Когда люди расширяют знания, учатся рассуждать над незнакомыми задачами, совершенствуют стратегии запоминания или приобретают когнитивные инструменты, позволяющие быстрее и точнее понимать мир, польза может переноситься на образование, работу, принятие решений, отношения и самостоятельность.

Измерение должно помогать признавать это достижение - а не отрицать его лишь потому, что интеллект отчасти стабилен, и не преувеличивать его лишь потому, что вырос один практиковавшийся показатель.

Образование имеет наиболее убедительные доказательства широкого воздействия

Крупный метаанализ, в котором особое внимание уделялось квазиэкспериментальным дизайнам, показал, что каждый дополнительный год образования в среднем давал преимущество примерно в 1–5 баллов IQ - в зависимости от дизайна и предположений - среди более чем 600 000 участников. Эффект проявлялся в разных широких категориях когнитивных способностей и на протяжении всей жизни.15

Это оценка для популяции, а не ежегодное обещание каждому человеку и не неограниченная линейная закономерность. Тем не менее это весомое свидетельство против представления о том, что измеренный интеллект застыл.

Стабильность и изменения не противоречат друг другу

Когнитивные способности от детства до взрослого возраста демонстрируют возрастающую ранговую стабильность: люди часто сохраняют примерно то же место по сравнению со сверстниками. Это не означает, что абсолютный результат никогда не меняется, что среда не имеет значения или что среднее значение группы не может сместиться. Самый полный на сегодняшний день метаанализ показал высокую - хотя и не идеальную - стабильность с позднего подросткового возраста на протяжении значительной части взрослой жизни.19

Показатели популяций менялись от поколения к поколению

На протяжении значительной части XX века результаты многих тестов интеллекта росли - это эффект Флинна. Метаанализ, охвативший 31 страну, выявил рост, различавшийся в зависимости от когнитивной области, места и периода, причём в последние десятилетия тенденции ослабевали.16 Именно поэтому тесты необходимо периодически перенормировать. Это не означает, что каждое новое поколение во всех смыслах становится мудрее, и не существует универсальной поправки «три балла за десятилетие» для каждого результата.

Не каждое улучшение означает одно и то же
Тип улучшения Что изменилось Лучшее доказательство
Улучшение благодаря практике Результат в повторяющихся или очень похожих задачах. Полезно для освоения конкретной задачи; без дополнительных доказательств не делайте вывод о широком переносе.
Улучшение навыка Развитая область, например арифметика, словарный запас, пространственная стратегия или привычка концентрировать внимание. Nепрактикуем тот же навык, измеряемый показатель и долгосрочный результат в реальной жизни.
Широкое когнитивное улучшение Способности переносятся на существенно отличающиеся задачи или области. Альтернативные показатели, активные контрольные группы, когда это возможно, и наблюдение с течением времени.
Изменение нормативного IQ Изменение положения относительно сверстников той же возрастной группы. Сопоставимые и актуальные нормы; доверительные интервалы; данные о надёжном изменении и повторном тестировании.

Тренировка мозга: оценивайте реальное улучшение и называйте его точно

Коммерческие когнитивные тренировки часто улучшают выполнение практикуемой задачи и иногда — выполнение очень похожих задач. Дальний перенос на общий интеллект в хорошо контролируемых обзорах обычно оказывается слабым или непоследовательным.18 Улучшение в конкретной области всё равно может быть полезным. Точность сохраняет прогресс: если каждое улучшение называть «более высоким IQ», настоящий рост становится труднее распознать.

Условия, поддерживающие обучение и когнитивное функционирование

Учитесь глубоко

Создавайте знания, неоднократно извлекайте их из памяти, объясняйте, связывайте и применяйте к новым проблемам.

Берегите мозг

Отдавайте приоритет сну, физическому здоровью, движению, питанию, безопасности и лечению препятствий для внимания или обучения.

Ищите вызов

Работайте немного выше текущего уровня мастерства, используя обратную связь, постепенную поддержку и достаточно времени для закрепления.

Отслеживайте перенос

Ищите устойчивое улучшение в новых задачах, реальной работе и повседневном понимании, а не только в знакомом упражнении.

Гены влияют на когнитивные различия, однако наследуемость — это статистика популяции в определённом диапазоне условий среды; это не процент интеллекта отдельного человека, который «вызван генами», и не доказательство того, что образование не работает.2 Стабильность описывает закономерность. Она не означает, что рост невозможен.

12 · Оригинальность и принадлежность

В одиночестве может сформироваться идея; сообщество может помочь ей жить

Оригинальная мысль и социальная связь не являются врагами. Часто они относятся к разным этапам одного и того же творческого цикла.

Защищённое блуждание

Время наедине с собой может освободить внимание от прямых инструкций, групповых ожиданий и давления необходимости реагировать. Человек может следовать за странным вопросом, терпимо относиться к незавершённой мысли и соединять идеи ещё до того, как кто-либо другой определит задачу.

Одновременное генерирование идей в группах может ограничиваться блокированием генерирования идей — ожиданием возможности высказаться, из-за чего мысль тем временем исчезает, — а также страхом оценки или снижением индивидуального вклада.32 Ранние примеры, предложенные другими, также могут вызывать коллективную фиксацию, сужая исследуемый диапазон ещё до того, как успеет сформироваться оригинальная мысль.35

Выбранное возвращение

Когда идея уже достаточно сформировалась, чтобы ею можно было поделиться, другие люди часто становятся ценными, а иногда и незаменимыми для её проверки, развития и распространения. Они могут ставить под сомнение предположения, привносить знания, испытывать работу, предоставлять ресурсы, улучшать коммуникацию, открывать двери и защищать создателя от слепых зон. В трёх контролируемых экспериментах по записи идей чередование индивидуальных и групповых сессий породило больше идей, чем постоянная работа только в одном режиме, - это свидетельствует о пользе гибкого цикла в лабораторной генерации идей, а не о существовании одной универсально лучшей среды для любой творческой работы.33

Добровольное возвращение может стать праздником: частная искра встречается с признанием, поддержкой и совместными усилиями. Разуму не обязательно оставаться в одиночестве, чтобы сохранять оригинальность.

Дайте оригинальности достаточно уединения, чтобы сформироваться, - и достаточно сообщества, чтобы расти, двигаться дальше, получать поддержку и быть отмеченной.
Ритм независимости и принадлежности

Ни один этап не должен превращаться в предписание. Уединение может стать изоляцией; сотрудничество - конформизмом. Некоторые люди лучше всего думают в диалоге, другие - в тишине, а многие чередуют оба режима. Здоровая модель гибка: отстраняйтесь без стыда, когда не направленной мысли нужна защита, и возвращайтесь без стыда, когда хочется общения, критики и совместного творчества.

Когда разум защищён от унижения, принуждения и постоянных помех, люди могут поддерживать интеллектуальный рост друг друга, не стирая различий. Интеллект становится чем-то большим, чем личное преимущество: он становится способностью, которой делятся через обучение, изобретения, заботу, честное несогласие и совместное решение проблем.

13 · Практическое применение

Выбор оценки - и подготовка к ней

Начните с решения, которое нужно улучшить. Абстрактно «лучший тест» может не подходить конкретному человеку, вопросу или юрисдикции.

01

Определите цель

Клиническая диагностика, образовательное планирование, выявление одарённости, поддержка людей с инвалидностью, научные исследования и личное любопытство требуют разных видов доказательств и разной точности.

02

Согласуйте с человеком

Проверьте возраст, язык, культурный контекст, доступность для людей с сенсорными и двигательными особенностями, потребности в коммуникации, опыт использования цифровых технологий и репрезентативность нормативных выборок.

03

Согласуйте с решением

Спросите, подтверждают ли руководство к тесту и независимые стандарты именно такую интерпретацию и нужны ли дополнительные доказательства.

Перед сессией

  • Для интерпретации, имеющей клинические, образовательные или иные значимые последствия, обратитесь к квалифицированному специалисту.
  • Сообщите важную информацию об истории развития речи, образовании, диагнозах, лекарствах, адаптациях и предыдущем тестировании.
  • Спросите, какие конструкты, баллы и сравнительные группы использует выбранная батарея тестов.
  • Сохраняйте привычный режим сна, питания, назначенного лечения и использования сенсорных средств; не пытайтесь в последнюю минуту «подготовиться к тесту на IQ».
  • Сообщите о необычном заболевании, боли, сильном стрессе или помехах, чтобы при необходимости можно было рассмотреть перенос тестирования.

Во время сессии

Старайтесь отвечать искренне, спрашивайте, если инструкции неясны, и сообщайте о препятствиях доступности. Не ищите утекшие задания и не учите защищённое содержание теста: это нарушает значимость результата. Обычная знакомость с головоломками является частью жизни; подготовка по защищённым вопросам конкретного теста меняет вывод, который может обосновать балл.

После сессии: вопросы, которые стоит задать

  • Каков был составной балл и его доверительный интервал?
  • Какие различия в профиле надёжны, редки и практически значимы?
  • Какие условия тестирования могли повлиять на результат?
  • Насколько хорошо результаты соответствовали истории и другим доказательствам?
  • Чего тест не измеряет?
  • Какие решения эти баллы могут обоснованно информировать?
  • Какой вызов, поддержка или последующее оценивание должны последовать?
  • Когда было бы полезно пройти тест повторно и как будет учтён эффект практики?

Личное любопытство тоже заслуживает контекста

Надёжное оценивание может дать ценные знания о себе. Считайте число одной координатой, а затем спросите, что оно помогает сделать: выбрать подходящий вызов, развивать более слабые способности, ответственно использовать сильные стороны и продолжать учиться. Погоня за небольшими различиями в баллах может заменить развитие тревогой, связанной с измерениями.

14 · Взгляд в будущее

Более быстрое тестирование не должно означать менее убедительных доказательств

Адаптивные платформы, данные о процессе и искусственный интеллект могут улучшить измерение, однако эффективность не равна валидности, а прогнозирование не означает понимания.

Компьютеризированное адаптивное тестирование

Алгоритм выбирает следующее задание из калиброванной базы на основе предыдущих ответов. Это позволяет достичь сопоставимой точности с меньшим числом заданий, однако это метод предъявления, а не новая форма интеллекта.

Данные о процессе

Время, исправления, изменения стратегий и последовательности ответов могут показать, как было найдено решение. Эти сигналы требуют независимой проверки и могут включать технологические или моторные требования.

Интерпретация с помощью ИИ

Системы могут выявлять закономерности, составлять черновики отчётов или предлагать гипотезы. Они не должны скрывать неопределённость, выдумывать диагнозы, воспроизводить предвзятость данных для обучения или подменять ответственное профессиональное решение.

Что ответственная инновация должна сделать видимым

  • Конструкт: что предполагается на основе наблюдаемого поведения.
  • Данные для обучения и нормирования: кто представлен, кого не хватает и когда были собраны данные.
  • Неопределённость: точность в разных диапазонах баллов, подгруппах и порогах принятия решений.
  • Справедливость: функционирование заданий, доступность, дифференциальный прогноз и последующие ошибки.
  • Конфиденциальность: какие чувствительные когнитивные данные и данные о поведении хранятся, связываются, сохраняются или передаются.
  • Подотчётность: кто может объяснить, обжаловать и исправить результат, имеющий важные последствия.

Одновременный сбор большего объёма поведенческих данных может создать более подробную модель и повысить риски для конфиденциальности. Голос, нажатия клавиш, направление взгляда, время задержки и модели взаимодействия могут раскрыть информацию об инвалидности, состоянии здоровья или личности, не связанную с заявленной целью. Поэтому минимизация данных, информированное согласие, безопасность и реальная возможность обжаловать результат должны быть встроены в дизайн теста, а не спрятаны в последнем нечитаемом абзаце.

Стандарт будущего

Лучшая оценка - не та, которая создаёт больше всего чисел. Она отвечает на важный вопрос с достаточной точностью, создаёт меньше ненужной нагрузки, раскрывает свои ограничения и ведёт к лучшим возможностям или поддержке.

15 · Ясные выводы

Распространённые мифы - исправлены

Большинство споров об IQ становятся понятнее, если абсолютное утверждение заменить ограниченным и точным.

Миф: IQ ничего не значит.
Исправление: хорошо валидированные тесты оценивают важные когнитивные способности и вероятностно прогнозируют значимые результаты.
Миф: IQ измеряет весь разум.
Исправление: он охватывает отобранные общие и специфические способности; для оценки креативности, ценностей, личности, эмоций и жизненного опыта нужны другие доказательства.
Миф: 120 означает на 20 % больше интеллекта, чем 100.
Исправление: стандартизированный IQ не является относительной шкалой. Различия показывают положение в нормативном распределении.
Миф: балл точен.
Исправление: каждый балл имеет погрешность измерения, и его следует интерпретировать как интервал с учётом контекстных ограничений.
Миф: интеллект неизменен.
Исправление: когнитивные различия могут быть стабильными, а образование и поддерживающая среда всё же способны привести к реальному развитию.
Миф: каждое улучшение при повторном тестировании означает повышение общего интеллекта.
Исправление: практика, стратегия и снижение тревожности могут повышать баллы; для широкого развития нужны доказательства переноса, устойчивости и надёжности изменений.
Миф: невербальный означает независимый от культуры.
Исправление: невербальные форматы снижают некоторые языковые требования, однако на них по-прежнему влияют инструкции, опыт, доступность и знакомство с тестированием.
Миф: различия между группами доказывают предвзятость.
Исправление: различия необходимо изучать. Справедливость зависит от задачи, конструкта, норм, прогностической ценности и доказательств последствий.
Миф: чтобы уважать высокий интеллект, нужно также утверждать наличие более высоких моральных качеств.
Исправление: IQ автоматически не доказывает мудрость или добродетель, однако может выявить редкую когнитивную способность. Эта способность - и работа всей жизни по её развитию - может иметь исключительное практическое значение и заслуживает серьёзного уважения.

Вывод: измеряйте то, что важно, а затем помогайте этому развиваться

Тестирование IQ - не приговор и не иллюзия. Хорошо разработанная и надлежащим образом нормированная оценка может дать полезное представление об общих и специфических когнитивных способностях. Эти способности важны: они способствуют более быстрому обучению, более глубокому пониманию, гибкому рассуждению и способности решать всё более сложные задачи.

Оценка всё же остаётся условной. Она содержит неопределённость, отражает конкретную выборку поведения и не может вместить в себя всего человека. Для надлежащего использования нужны подходящие нормы, доступная процедура проведения, доказательства, обосновывающие предполагаемую интерпретацию, и сдержанность, когда последствия значительны. Дополнительные оценки должны расширять картину, не создавая видимость, будто все ценные способности представляют собой одно скрытое число.

Главное - измерение должно служить развитию. Образование может укреплять когнитивные результаты; здоровье и безопасность защищают мозг; вызовы, обратная связь и практика формируют знания и навыки; уединение может оберегать оригинальное мышление; сообщество может помочь ему созреть и выйти в мир. Цените устойчивый когнитивный рост - и подтверждённое повышение IQ, когда учтены перенос, сохранение результата, эффект практики и погрешность измерения, - затем используйте возросшие способности для углубления понимания, расширения возможностей и улучшения жизни.

Измеряйте интеллект осторожно, помогайте ему развиваться и защищайте людей, в которых он живёт. Цените выдающиеся способности, обучение на протяжении всей жизни, оригинальное мышление и накопленную мудрость. Обеспечьте развитому уму здоровье, свободу, уединение, сообщество, вызовы и уважение, необходимые ему, - ведь когда такой ум заброшен или утрачен, человечество может потерять ориентиры, понимание и возможности, которые не способны просто заменить ни богатство, ни база данных.

Библиотека доказательств

Источники и дополнительная литература

Основные стандарты, официальные руководства, исторические источники и рецензируемые исследования, использованные в этом руководстве.

  1. AERA, APA и NCME. Стандарты образовательного и психологического тестирования (2014).
  2. Deary, Cox и Hill. Генетическая вариативность, мозг и различия в интеллекте. Molecular Psychiatry (2022).
  3. Brysbaert и Nicolas. Два устойчивых мифа о Бине и зарождении тестов интеллекта в учебниках по психологии. Collabra: Psychology (2024).
  4. Binet & Simon. Развитие интеллекта у детей (1908, оригинал на французском языке).
  5. Kovacs & Pléh. Уильям Стерн: значение его программы «дифференциальной психологии» для современных измерений интеллекта и исследований. Журнал интеллекта (2023).
  6. Terman. Измерение интеллекта (1916).
  7. Министерство обороны США. История военного тестирования.
  8. Warne ir kt. Анализ Стивена Джея Гулда армейского теста «Бета» в книге Неверное измерение человека: искажения и заблуждения относительно новаторского теста умственных способностей. Журнал интеллекта (2019); Brigham. Тесты интеллекта для групп иммигрантов. Психологический обзор (1930).
  9. Национальный институт исследования генома человека. Евгеника и научный расизм; Snyderman & Herrnstein. Тесты интеллекта и Закон об иммиграции 1924 года (1983).
  10. Boake. От Бине-Симона до Векслера-Белвью. Журнал клинической и экспериментальной нейропсихологии (2002).
  11. McGrew. Трёхстратовая теория когнитивных способностей Кэрролла (3S) спустя 30 лет: влияние, уточнение теории 3S-CHC, структурная репликация и расширение психометрического сетевого анализа когнитивных способностей и достижений. Журнал интеллекта (2023).
  12. Pearson Assessments. Шкала интеллекта Векслера для взрослых, пятое издание.
  13. Национальные академии. Психологическое тестирование для определения инвалидности (2015).
  14. Sackett ir kt. Повторный анализ метааналитических оценок валидности при отборе персонала: устранение систематической чрезмерной коррекции ограничения диапазона. Журнал прикладной психологии (2022).
  15. Ritchie и Tucker-Drob. В какой степени образование повышает интеллект? Метаанализ. Психологическая наука (2018).
  16. Pietschnig и Voracek. Век глобального роста показателей IQ: формальный метаанализ эффекта Флинна. Перспективы психологической науки (2015).
  17. Scharfen, Peters и Holling. Эффекты повторного тестирования в тестах когнитивных способностей: метаанализ. Интеллект (2018).
  18. Simons и др. Действительно ли работают программы «тренировки мозга»? Психологическая наука в общественных интересах (2016).
  19. Breit и др. Стабильность когнитивных способностей: метааналитический обзор лонгитюдных исследований. Психологический бюллетень (2024).
  20. Международная комиссия по тестированию. Рекомендации ITC по переводу и адаптации тестов (второе издание) (2017).
  21. Putnick и Bornstein. Принципы обеспечения инвариантности измерений и представления результатов. Обзор исследований развития (2016).
  22. Европейская федерация ассоциаций психологов. Модель экспертной оценки тестов EFPA, версия 2025 года.
  23. Американская ассоциация по интеллектуальным нарушениям и нарушениям развития. Определение интеллектуальной недостаточности.
  24. Miyake и др. Единство и разнообразие исполнительных функций. Когнитивная психология (2000).
  25. Toplak, West и Stanovich. Показатели исполнительных функций, основанные на выполнении заданий и рейтинговой оценке. Журнал детской психологии и психиатрии (2013).
  26. Swanson и Lussier. Избирательный синтез экспериментальной литературы по динамической оценке. Обзор исследований в области образования (2001).
  27. ОЭСР. Концептуальная рамка творческого мышления PISA 2022.
  28. Karwowski и др. Как результаты тестов интеллекта связаны с творческими достижениями? Метаанализ. Journal of Intelligence (2021).
  29. O’Connor и др. Измерение эмоционального интеллекта: критический обзор литературы и рекомендации для исследователей и практиков. Frontiers in Psychology (2019).
  30. MacCann и др. Эмоциональный интеллект предсказывает академическую успеваемость: метаанализ. Psychological Bulletin (2020).
  31. Waterhouse. Множественный интеллект, эффект Моцарта и эмоциональный интеллект: критический обзор. Educational Psychologist (2006).
  32. Mullen, Johnson & Salas. Снижение продуктивности в группах мозгового штурма: метааналитическое обобщение. Basic and Applied Social Psychology (1991).
  33. Korde & Paulus. Чередование индивидуальной и групповой генерации идей: поиск неуловимой синергии. Journal of Experimental Social Psychology (2017).
  34. Flore & Wicherts. Влияет ли угроза стереотипа на результаты девочек в стереотипных областях? Метаанализ. Journal of School Psychology (2015).
  35. Kohn & Smith. Совместная фиксация: влияние идей других людей на мозговой штурм. Applied Cognitive Psychology (2011).

Учебное примечание и примечание об оценивании: в этой статье представлена общая информация, а не индивидуальный диагноз, интерпретация баллов, юридическое заключение или замена оценки квалифицированного психолога либо другого надлежащим образом сертифицированного специалиста. Выбор тестов, адаптации, критерии пригодности и юридические требования различаются в зависимости от места и цели.

Продолжить исследование
Вернуться на главную страницу «Освобождённый интеллект»
Вернуться к блогу