Вимірювання інтелекту
Linas JuozėnasПоділитися
Вимірюйте інтелект, не звужуючи розум
Інтелект важливий. Сильніше міркування, кращі пам’ять, знання та здатність до навчання можуть допомогти людям більше розуміти, швидше вчитися, розв’язувати складніші проблеми й самостійніше орієнтуватися в житті. Якісні тести IQ можуть вимірювати важливі складові цієї здатності. Найкориснішими вони стають тоді, коли ми розглядаємо їх як ретельно сформовані оцінки — а не як ідентичність, вирок чи межу.
Корисний сигнал, інтерпретований у контексті
Результат тесту інтелекту — це приклад виконання відібраних когнітивних завдань у визначених умовах. Добре розроблені батареї тестів можуть надати інформацію про ширші здібності, можливі відносні сильні сторони та потреби в підтримці, а також допомогти планувати освіту чи подальше клінічне оцінювання. Їхні бали мають сенс саме тому, що їхні твердження мають чіткі та перевірювані межі.1
Правильне запитання не таке: «Чи важливий IQ, чи важлива вся людина?» Важливі обидва аспекти. Когнітивні здібності впливають на навчання та багато життєвих результатів, а гідність, моральну цінність, мету й усе багатство розуму неможливо звести до одного бала.
Винятковий інтелект може мати виняткове значення
Вищий валідний бал є вагомим доказом того, що людина краще виконує ті здібності, які вимірює тест. Ця відмінність важлива, і її не слід применшувати. У поєднанні з допитливістю, дисципліною, знаннями та мудрістю виняткові когнітивні здібності можуть зробити людину надзвичайно важливою для інших людей і суспільства — допомогти помічати приховані зв’язки, розв’язувати складні проблеми, зберігати знання та спрямовувати роботу, яку інакше, можливо, ніколи не було б виконано.
Сам бал не доводить мудрості, характеру чи досягнень, а базова людська гідність однаково належить усім. Однак однакова гідність не вимагає вдавати, ніби всі здібності чи внески однакові. Рідкісний інтелект і інтелектуальна майстерність, важко здобута завдяки розвитку, заслуговують на справжнє визнання, захист і повагу.
Як читати знайому шкалу IQ
Багато сучасних складених балів нормують так, щоб середнє дорівнювало 100, а стандартне відхилення - 15. Наведена нижче ілюстрація показує приблизне положення в нормальному розподілі; назви та інтерпретації відрізняються залежно від тесту, його версії, віку та нормативної групи.
На основі норм
Бал порівнює результат із відповідною стандартизаційною вибіркою, зазвичай із людьми приблизно такого самого віку. Він не підраховує безпосередньо фіксовану «кількість інтелекту».
Оцінка, а не вирок
Надійність ніколи не буває досконалою. У звіті слід зазначити довірчий інтервал і пояснити, чи перевищують невеликі відмінності очікувану похибку вимірювання.
Профіль може надати важливий контекст
Надійні відмінності між ширшими сферами можуть запропонувати гіпотези про відносні сильні сторони та потреби в підтримці. Коливання окремого субтесту не слід вважати діагностичними.
Що насправді вимірює IQ-тест
Батарея IQ-тестів безпосередньо не заглядає в розум. Вона використовує стандартизовані завдання для отримання поведінкових даних, послідовно оцінює результат і перевіряє, чи сформована модель обґрунтовує конкретну інтерпретацію.
Більшість комплексних тестів інтелекту охоплюють кілька когнітивних сфер: міркування з новою інформацією, набуті вербальні знання, візуально-просторовий аналіз, робочу пам’ять та ефективність обробки інформації. Результати цих завдань позитивно корелюють між собою, тому ширший складений бал може узагальнювати значущу загальну вимірність когнітивного функціонування.2
Цей складений бал є потужним, тому що стискає інформацію. З тієї самої причини він є неповним. Мотивація, допитливість, креативність, емоційні навички, практичні знання, наполегливість, здоров’я, цінності та можливості можуть впливати на те, чого людина досягає завдяки своїм здібностям, але не є тотожними загальним когнітивним здібностям.
Спочатку конструкт, а вже потім число
Для кожного бала потрібне речення, що починається так: «Цей результат надає докази щодо…» Наприкінці слід назвати конструкт, популяцію, умови та передбачене використання. Якщо речення перетворюється на «це число розповідає нам усе про людину», інтерпретація вже вийшла за межі доказів.
Короткий ключ до термінів: конструкт – здатність, про яку роблять висновок; батарея – набір завдань; субтест – приклад вужчої навички; індекс – поєднання кількох пов’язаних субтестів; складений бал – підсумок ширшої моделі; а нормативна група – референтна вибірка, за якою інтерпретують місце людини.
| Термін | Що він означає | Чого він не означає |
|---|---|---|
| Первинний бал | Кількість завдань, на які правильно відповіли, або набраних балів до конвертації за нормами. | Показник, який можна безпосередньо порівнювати між різним віком, версіями або різними тестами. |
| Стандартизований бал | Перетворений бал, що показує місце в референтному розподілі. | Відсоток усього інтелекту, яким володіє людина. |
| Процентиль | Приблизна частка нормативної групи, яка отримала такий самий або нижчий результат. | Відсоток правильних відповідей або відсоток, на який одна людина «розумніша» за іншу. |
| Довірчий інтервал | Інтервал, що визнає невизначеність спостережуваного бала. | Гарантія, що прихований «справжній бал» назавжди зафіксований у межах цього інтервалу. |
Як надійний тест здобуває авторитет
Відшліфований інтерфейс, складні головоломки або ярлик «на основі ШІ» не роблять інтелектуальний тест валідним. Довіру потрібно заслужити документально підтвердженими доказами.
Чіткий конструкт
Розробник визначає, які здібності має вимірювати тест, що свідомо залишає поза межами та які інтерпретації є обґрунтованими.
Стандартизоване виконання
Інструкції, час, підказки, правила оцінювання та умови тестування контролюються, щоб результати залишалися порівнюваними.
Відповідні норми
Достатньо велика й відповідна вибірка надає точку відліку для інтерпретації. Застарілі або погано підібрані норми можуть спотворити місце людини.
Надійність
Бали є достатньо послідовними між завданнями, формами, оцінювачами або повторними тестуваннями для передбаченого рішення. Що важливіше рішення, то вищою має бути потрібна точність.
Докази валідності
Зміст, процеси відповідей, внутрішня структура, зв’язки з іншими змінними та наслідки обґрунтовують запропоновану інтерпретацію й використання.
Справедливість і доступність
Розробники досліджують бар’єри, функціонування завдань у різних групах і адаптації, а потім чітко зазначають, де докази слабкі або використання недоречне.
Надійність необхідна - але її недостатньо
Ваги, які щоразу показують на п’ять кілограмів більше, є надійними, але неточними. Так само когнітивний тест може послідовно ранжувати результат, не обґрунтовуючи кожну інтерпретацію, яку з нього роблять. Професійні стандарти оцінюють валідність як докази, що підтримують конкретну інтерпретацію для конкретного використання, а не як постійний ярлик, прикріплений до тесту.1
Стандартна похибка та довірчі інтервали
Оскільки тест бере вибірку поведінки, спостережуваний бал має певну невизначеність. Довірчий інтервал виражає цю неточність, використовуючи надійність тесту та шкалу балів. Інтервал не охоплює всіх можливих джерел похибки - наприклад, поганого сну, неправильного розуміння інструкцій, невідповідності мови або незвичного дня тестування, - однак є чеснішим, ніж подання одного числа як абсолютно точного.
Спрощений приклад
У класичній теорії тестів стандартну похибку вимірювання можна проілюструвати формулою SD × √(1 − надійність). Для шкали зі стандартним відхиленням 15 і надійністю 0,95 отримуємо приблизно 3,35 бала. У цьому спрощеному прикладі спостережуваний результат 120 мав би приблизний 95 % інтервал 113–127.
Чому важливе слово «спрощений»
Реальна інтерпретація має використовувати наведені в посібнику оцінки похибки, визначені за віком, балом і дозволом. Точність у різних ділянках шкали може відрізнятися, особливо поблизу крайніх результатів. Бали змін і різниць також мають власну похибку, і їх не можна оцінювати лише за надійністю кожного окремого бала.1
Коли два індексні бали відрізняються, оцінювач має запитати більше, ніж лише про те, чи досягає різниця статистичного порога. Як часто різниця такого розміру трапляється в нормативній вибірці? Чи повторюється вона у споріднених завданнях і в історії? Чи пов’язана вона з питанням оцінювання? Інакше профіль, що має драматичний вигляд, може перетворитися на історію, створену зі цілком звичайного коливання.
Інструмент для підтримки, історія прогресу – і застереження щодо влади
Тестування інтелекту не виникло одразу в завершеному вигляді. Його історія охоплює гуманні освітні цілі, значні технічні прориви, необґрунтовані висновки та примусове зловживання. Розуміння всіх чотирьох аспектів допомагає краще вимірювати здібності сьогодні.
Попередник із 30 завдань перетворюється на докладнішу шкалу, розподілену за віком і призначену для виявлення дітей, яким може знадобитися інше навчання.
Вільям Стерн пропонує «коефіцієнт інтелекту»: оцінений розумовий вік ділиться на хронологічний вік.
Льюїс Терман адаптує та розширює шкалу для Сполучених Штатів і популяризує відносний IQ, виражений цілими числами.
Тестування дорослих поєднує вербальні завдання та завдання на виконання й розширює застосування вікових норм для стандартних балів відхилення.
Сучасні батареї тестів надають складені бали та бали за окремими сферами відповідно до визначених норм, разом із доказами надійності та валідності.
Біне й Симон: поточний результат, а не довічна доля
1905 року Альфред Біне й Теодор Симон опублікували впливового попередника з 30 завдань; у докладнішій редакції 1908 року завдання було розподілено за віковими рівнями, і вона вже більше нагадувала практичну шкалу інтелекту, описану в пізніших підручниках. Ця робота виросла з французьких дискусій про те, як виявляти й навчати дітей, яким важко навчатися у звичайних класах. Завдання охоплювали такі здібності, як розуміння, пам’ять і ухвалення рішень, щоб системніше розпізнавати поточні потреби.34
Це ще не був сучасний тест IQ, і в ньому не використовувався коефіцієнт, запропонований пізніше Стерном. Біне описував шкалу як практичну ієрархію, а не буквальне вимірювання на кшталт фізичної довжини, і виступав проти ідеї, що низький результат доводить незмінний рівень здібностей. Цю обережність не слід романтизувати до твердження, ніби будь-яка здатність може зростати безмежно. Її довготривала цінність простіша: результат має допомагати підібрати підтримку, а не ставати вироком.
Стерн, Терман і число під назвою IQ
1912 року німецький психолог Вільям Штерн запропонував термін Intelligenzquotient: оцінений розумовий вік ділиться на хронологічний вік. Редакція Стенфордської шкали Льюїса Термана 1916 року перейняла цей коефіцієнт, помножила його на 100 і сприяла популяризації «IQ» в освіті США.56 Ці ранні результати були відносними IQ. Це ще не були стандартні бали відхилення, які використовуються сьогодні й розміщують результат людини відповідно до нормативного розподілу тієї самої вікової групи.
Масове тестування та небезпека виходу за межі даних
Під час Першої світової війни Army Alpha тестувала групами новобранців, грамотних англійською, тоді як переважно візуальна Army Beta була призначена для новобранців із низьким рівнем грамотності або обмеженим знанням англійської мови. Програма показала, що психологічні тести можна адмініструвати в масштабах мільйонів і використовувати для практичної класифікації.7
Історична невдача почалася тоді, коли результати, на які впливали мова, шкільна освіта, акультурація, відбір та умови тестування, було розтягнуто до тверджень про вроджену расову чи національну ієрархію. Яскравим прикладом стала інтерпретація Карлом Брігемом даних Army 1923 року; до 1930 року він сам відкинув підґрунтя цих порівнянь. Расові інтерпретації тестів надали науковоподібного авторитету ширшій євгенічній та нативістській культурі, хоча твердження, що тести Army безпосередньо зумовили ухвалення Закону США про імміграцію 1924 року, перебільшують архівні докази.89
Урок - точність, права та самостійність
Євгеніка ранжувала людські життя й позбавляла людей самостійності через сегрегацію, відчуження та репродуктивний примус. Допомога людям у зміцненні когнітивних функцій через освіту, харчування, охорону здоров'я, безпеку та вільно обрану практику робить протилежне - розширює самостійність. Інтелектуальне зростання можна відзначати, водночас поважаючи рівність людей, якщо здібності розвивають і використовують на благо - а не плутають із правом на гідність.
Векслер і сучасний профіль, нормований за віком
Шкала Wechsler-Bellevue Девіда Векслера 1939 року була створена для клінічного використання дорослими. Вона поєднувала вербальні завдання та завдання на виконання і порівнювала дорослих із людьми того самого віку, допомагаючи галузі відійти від буквальних співвідношень розумового віку. 1949 року з'явилася WISC для дітей, а 1955 року - перша WAIS.10 Пізніші батареї дедалі частіше поєднували широкий складений бал із інтерпретованими балами за сферами - ця архітектура залишається важливою й сьогодні.
Як загальні та специфічні здібності узгоджуються між собою
Широко використовуваний психометричний підхід є ієрархічним: когнітивні завдання мають дещо спільне, однак для різних завдань також потрібні більш специфічні здібності.
Загальний фактор, g
Люди, які добре виконують одне достатньо складне когнітивне завдання, у середньому схильні добре виконувати й інші. Факторний аналіз узагальнює цю позитивну модель результатів загальним фактором, який зазвичай називають g. Це один із найбільш неодноразово підтверджених результатів у психології.2
g є статистичною закономірністю, а не крихітною речовиною в одному регіоні мозку, і теорії не погоджуються щодо механізмів, з яких вона виникає. Її корисність не потребує вдавати, що ці механізми повністю з’ясовані.
Широкі та вузькі здібності
Ієрархічні системи, такі як Cattell–Horn–Carroll, організовують результат на загальний рівень, широкі здібності та вужчі навички. Плинне міркування та набуті знання є яскравими прикладами; інші сфери можуть охоплювати візуальну обробку, короткочасну робочу пам’ять, швидкість відтворення та швидкість обробки інформації.11
CHC найкраще розуміти як таксономію, засновану на психометричних доказах, а не як твердження, що кожна батарея тестів досконало реалізує ту саму карту.
Складений бал запитує: «Яка широка модель є найбільш обґрунтованою?» Профіль запитує: «Чи є якісь відмінності між широкими сферами, достатньо надійні, рідкісні та підтверджені іншими даними, щоб обґрунтувати гіпотезу?»
Специфічним балам варто приділяти увагу тоді, коли вони достатньо надійні, ґрунтуються більш ніж на одному завданні та надають важливу додаткову інформацію поза межами складеного бала для конкретного застосування. Менше уваги вони заслуговують тоді, коли ймовірне підвищення або зниження залежить від одного короткого субтесту. Широкі бали часто надійніші; вужчі можуть спрямовувати подальше оцінювання, однак їхню освітню чи клінічну корисність не слід вважати самоочевидною.
Що можуть оцінювати сучасні тести інтелекту
Батареї тестів відрізняються за віком, призначенням і теорією. Наведені нижче сфери ілюструють поширені цілі, а не універсальну структуру, притаманну кожному тесту.
| Сфера | Типова вимога | Обережність інтерпретації |
|---|---|---|
| Плинне міркування | Виявляти правила, передбачати зв’язки та розв’язувати незнайомі проблеми. | Попереднє знайомство з форматами головоломок, стратегія та навчання також мають значення. |
| Набуті знання / вербальне розуміння | Використовувати словниковий запас, поняття та культурно передані знання. | Мова, шкільна освіта та можливість навчатися є невід’ємними складовими результату. |
| Візуально-просторова обробка | Аналізувати, трансформувати або створювати просторові моделі. | Зір, моторна реакція та досвід роботи з діаграмами можуть впливати на результат. |
| Робоча пам’ять | Утримувати та опрацьовувати інформацію протягом короткого часу. | Увага, слух, тривожність і стратегія можуть впливати на короткий приклад виконання. |
| Швидкість обробки інформації | Виконувати прості візуальні рішення точно й ефективно в умовах обмеженого часу. | Моторна швидкість, доступність зору та обережний стиль відповідей можуть впливати на бал. |
| Тривале запам’ятовування / швидкість відтворення | Efektyviai atkurti išmoktas asociacijas ar generuoti informaciją. | Žinių bazė, kalba ir konkrečiai užduočiai skirta praktika veikia rezultatą. |
Profesionaliai sukurtų priemonių pavyzdžiai – Stanford–Binet, Wechslerio skalės, Woodcock–Johnson kognityvinė baterija, Kaufmano baterijos ir Raveno matricos. Vien prekių ženklo nepakanka. Svarbus tinkamas leidimas, amžiaus intervalas, kalba, normos, vertintojo kvalifikacija ir naudojimo tikslas. Dabartinė suaugusiųjų Wechslerio baterija Jungtinėse Valstijose, pavyzdžiui, yra WAIS–5, tačiau prieinamumas ir patvirtintos versijos skirtingose šalyse skiriasi.12
Atranka nėra išsamus vertinimas
Trumpa atrankos priemonė gali parodyti, ar verta atlikti išsamesnį vertinimą. Neverbalinė matricų užduotis gali vertinti abstraktų samprotavimą sumažindama kalbos poreikį. Internetinis testas gali būti įdomus ar edukacinis. Tačiau nė vienas automatiškai neturi tokio platumo, prižiūrimų sąlygų, apsaugotų užduočių, reprezentatyvių normų ir interpretacinių įrodymų kaip profesionaliai administruojama baterija.
Kaip skaityti kognityvinio vertinimo ataskaitą
Atsakinga ataskaita paverčia skaičius ribotomis išvadomis, patikrina konkuruojančius paaiškinimus ir susieja rezultatus su naudingais veiksmais.
Pradėkite nuo vertinimo klausimo
- Kodėl buvo paprašyta vertinimo?
- Koks testas ir leidimas naudoti, ir ar jie čia tinkami?
- Kas sudarė norminę grupę ir kada normos surinktos?
- Ar administravimas ir vertinimas buvo standartizuoti?
- Ar atlikimas reprezentavo įprastą žmogaus funkcionavimą?
Tada skaitykite nuo plataus prie konkretaus
- Sudėtinis balas ir pasikliautinasis intervalas
- Patikimi ir prasmingi indeksų skirtumai
- Sutampantys subtestai – ne pavienės aukštumos ar žemumos
- Elgesio stebėjimai ir testavimo sąlygos
- Atitikimas mokymosi, darbo ir kasdienio gyvenimo istorijai
Bendrasis balas ir indeksų profilis
Platus sudėtinis balas dažnai yra patikimiausia bendro rezultato santrauka. Dideli ir patikimi sričių skirtumai kartu gali suteikti kliniškai svarbios informacijos, tačiau išsibarstęs profilis savaime nepanaikina sudėtinio balo. Netolygus profilis automatiškai neįrodo konkretaus sutrikimo, o aukščiausias balas nebūtinai yra žmogaus „tikrasis IQ“. Vertintojas turėtų nustatyti, ar skirtumai statistiškai patikimi, pakankamai reti, kad būtų verti dėmesio, ir paremti nepriklausomais įrodymais.
Rezultatas priklauso nuo situacijos
Miego trūkumas, skausmas, ūmi liga, nerimas, depresija, vaistų poveikis, klausos ar regos kliūtys, motoriniai reikalavimai, nepažįstama kalba, nutrūkęs švietimas, silpnas įsitraukimas ir nesuprastos instrukcijos gali paveikti stebimą rezultatą. Kai kurios iš šių sąlygų yra realaus funkcionavimo, kurį norima tirti, dalis; kitos – nereikšmingos kliūtys. Interpretacija turi jas atskirti, o ne automatiškai pridėti ar atimti balus.
Pakartotinis testavimas ir praktikos poveikis
Вищий бал під час повторного тестування може відображати запам’ятовування формату, нові стратегії, меншу тривожність або перекривання завдань. Ці ефекти практики є справжнім покращенням виконання тесту, але не обов’язково означають таке саме широке зростання базової здібності. Розмір залежить від інтервалу, віку, тесту та попередніх спроб; допомагають альтернативні форми й належні рекомендації щодо повторного тестування.17
Просіть про корисну невизначеність
Гарне пояснення звучить так: «Результат у цій сфері оцінено в цьому діапазоні; імовірно, він має сенс, оскільки ці завдання узгоджуються між собою та з історією людини. На нього могли вплинути ці умови. Ось що цей результат пропонує спробувати далі».
Що прогнозує IQ - і чого не прогнозує
Загальні когнітивні здібності мають реальні наслідки. Вони прогнозують імовірності в групах, а не наперед визначені біографії конкретних людей.
Навчання
Міркування, знання та пам’ять допомагають легше розуміти навчання, пов’язувати ідеї та набувати складних навичок. Когнітивні здібності істотно пов’язані з результатами навчання.2
Складна робота
Загальні розумові здібності прогнозують результативність роботи, хоча оновлені метааналітичні оцінки є помірнішими, ніж деякі старі твердження.14
Орієнтування в житті
У популяціях вищий когнітивний результат пов’язаний із вищою освітою, складнішою роботою та деякими показниками здоров’я й довголіття. Ці зв’язки виникають через численні індивідуальні та соціальні шляхи; вони не визначають майбутнього людини.2
Кореляція - не особисте пророцтво
Кореляція описує, як змінні мають тенденцію змінюватися разом у популяції. Вона не означає, що сам бал спричиняє результат або що всі люди з однаковим балом житимуть однаково. Якість освіти, здоров’я, ресурси сім’ї, особистість, інтереси, дискримінація, мотивація, стосунки, цінності та випадковість впливають і на можливості, що виникають, і на те, як використовуються здібності.
Навіть сильний зв’язок залишає величезний простір для індивідуальних відмінностей. Водночас вислів «IQ - це не все» не можна спотворювати до «IQ нічого не означає». Здібності, що допомагають розуміти, міркувати й навчатися, варто берегти, розвивати й цінувати.
| Докази можуть обґрунтувати | Самі по собі докази не можуть обґрунтувати |
|---|---|
| Оцінку вибраних загальних і специфічних для певної сфери когнітивних здібностей. | Вичерпний опис свідомості, особистості, мудрості чи творчості. |
| Імовірнісні прогнози важливих результатів для популяцій, у яких цей інструмент валідований. | Точні прогнози майбутнього однієї людини. |
| Визначення деяких сильних сторін, потреб або розбіжностей у навчанні. | Автоматичний діагноз або визначення місця навчання без інших доказів. |
| Докази змін, якщо враховано метод, норми, невизначеність і ефект повторного тестування. | Твердження, що кожна зміна бала є широким інтелектуальним зростанням - або що зростання неможливе. |
| Причину запропонувати виклик, можливості, визнання чи цілеспрямовану підтримку – і берегти рідкісну здатність від марнування чи непотрібної шкоди. | Повного рейтингу людської гідності чи основоположних прав; їх психометричний бал не надає. |
Культура, мова, інвалідність і доступність
Справедливість не є декоративною фінальною перевіркою. Вона є частиною питання про те, чи є запропонована інтерпретація бала валідною для цієї людини, популяції та мети.
Жодне оцінювання не є вільним від культури. Мова, освіта, досвід проходження тестів, візуальні конвенції, доступність технологій, вимоги до швидкості, мотивація та взаємини з авторитетом можуть впливати на результат. Це не означає, що кожна відмінність між групами є «упередженістю», так само як сама відмінність між групами не доводить ані упередженості, ані відмінностей у вроджених здібностях. Емпіричне питання полягає в тому, чи несуттєві перешкоди істотно спотворюють конструкт, який тест має вимірювати.
Соціальний контекст може впливати на результат – але величина впливу не є універсальною
Занепокоєння через необхідність підтвердити негативний стереотип групи іноді може поглинати увагу або змінювати залученість під час тестування. Це явище називають загрозою стереотипу. Метааналіз математичних, природничо-наукових і просторових завдань для дівчат віком до 18 років виявив невеликий середній ефект, але також серйозні ознаки упередженості публікацій; цей результат не можна перетворювати на одне всеохопне пояснення кожної відмінності між групами чи в балах.34 Практичний висновок ширший: шанобливе проведення, психологічна безпека та справедлива можливість зрозуміти завдання покращують якість доказів для всіх.
| Рівень | Запитання |
|---|---|
| Доступність і проведення | Чи може людина сприйняти, зрозуміти та відповісти без несуттєвої мовної, сенсорної, моторної чи технологічної перешкоди? |
| Завдання | Чи мають люди з різних груп, які мають однакову вимірювану здатність, різну ймовірність правильно відповісти на конкретне завдання? |
| Шкала / конструкт | Чи працює основна структура достатньо подібно в різних групах, щоб передбачене порівняння було обґрунтованим? |
| Норми | Чи є референтна вибірка придатною, новою, достатньо репрезентативною та прозоро описаною? |
| Рішення / результат | Чи прогнозує бал важливі критерії та класифікує людей із прийнятною точністю, зокрема у випадках поблизу порогових значень? |
Диференційне функціонування завдання є сигналом для дослідження
Диференційне функціонування завдання (DIF) виникає тоді, коли люди з різних груп, які мають однакову вимірювану здатність, усе одно мають різну ймовірність відповісти на завдання певним чином. DIF автоматично не доводить упередженість: оцінювачі аналізують його величину, зміст, можливу причину та вплив на загальний бал. Автоматичне вилучення кожного позначеного завдання також може зіпсувати охоплення змісту.
Вимірювальна інваріантність запитує, чи означають порівняння те саме
Аналізи інваріантності досліджують, чи діють для факторної структури тесту, зв’язків і рівнів показників у різних групах достатньо подібні правила. Різні рівні інваріантності обґрунтовують різні твердження; доказів, достатніх для порівняння зв’язків, може бути недостатньо для порівняння середніх значень груп. Інваріантність є цінним доказом, заснованим на моделі, а не доказом того, що кожна соціальна чи вимірювальна проблема зникла.21
Переклад — це не те саме, що адаптація
Перекладене оцінювання має зберігати більше, ніж слова. Значення конструкту, інструкції, приклади, графіка, формати відповідей, оцінювання, норми та проведення мають бути переглянуті з культурного й емпіричного погляду. Зворотний переклад може допомогти виявити невідповідності, але сам по собі не доводить еквівалентності. Настанови International Test Commission рекомендують міждисциплінарну компетентність, пілотні дослідження та докази на рівнях завдання, методу й конструкту.20
«Невербальний» означає меншу потребу в мовленні, а не нейтральний контекст
Такі завдання, як матричне міркування, можуть зменшити залежність від словникового запасу та набутих вербальних знань. Однак їхні інструкції, абстрактні візуальні конвенції, швидкість, моторна реакція та знайомство з головоломками все одно відображають досвід. Для них потрібні такі самі докази надійності, валідності, нормування та справедливості, орієнтовані на конкретну популяцію, як і для вербальних показників.
Адаптація
Зміна, призначена усунути перешкоду, не пов’язану з вимірюваним конструктом, і зберегти значення показника. Вона має бути індивідуалізованою, задокументованою та обґрунтованою доказами.
Модифікація
Зміна, яка змінює цільовий конструкт або стандартизоване порівняння. Вона може бути гуманною та корисною, але отриманий показник може бути непорівнюваним із первинними нормами.
Додатковий час може зберегти порівнюваність, коли швидкість не є частиною конструкту; коли саме швидкість обробки є вимірюваним конструктом, додатковий час може змінити значення показника або зробити стандартні часові норми непридатними. Така сама обережність потрібна щодо перекладачів, читців, помічників, які пишуть, альтернативних інтерфейсів і спрощених інструкцій. Однакове проведення не завжди є справедливим; змінене проведення не завжди є валідним.22
Для справедливості потрібні і знання громади, і психометричні докази
Консультації з учителями, сім’ями та членами громади можуть допомогти виявити недоступні формулювання, відсутні місцеві знання або шкідливі припущення, яких не помічають віддалені розробники. Така інформація має формувати гіпотези для документованих досліджень доступності, стандартизації, надійності, валідності та результатів; сама по собі вона не доводить справедливість.120
Чим серйозніші наслідки, тим надійнішими мають бути запобіжники
Той самий показник може бути достатнім для дослідження моделей груп, але значно надто неточним для ухвалення рішень щодо освіти, діагностики, роботи чи доступу до послуг окремої людини.
Psichologinis testavimas yra viena vertinimo dalis. Svarbi išvada turėtų apjungti vertinimo klausimą, asmeninę ir raidos istoriją, stebėtą elgesį, reikšmingus dokumentus ir kitus matus, užuot leidus vienam skaičiui tyliai tapti visu sprendimu.13
Naudokite kelis šaltinius
Kognityvinius rezultatus derinkite su svarbiais pasiekimų, istorijos, stebėjimo, interviu, darbų pavyzdžių ar adaptyviojo funkcionavimo duomenimis.
Gerbkite neapibrėžtumą
Vertinkite pasikliautinuosius intervalus, skirtumų patikimumą ir klasifikavimo paklaidą šalia bet kokio slenksčio.
Patikrinkite tinkamumą
Patvirtinkite kalbą, normas, prieinamumą, vertintojo kompetenciją ir validumo įrodymus šiai populiacijai bei naudojimo tikslui.
Sukurkite kelią pirmyn
Rezultatas turėtų vesti į tinkamą iššūkį, paramą, mokymą ar tolesnį tyrimą – ne į aklavietę su etikete.
Intelekto sutrikimas nediagnozuojamas vien pagal IQ
Šiuolaikiniai apibrėžimai reikalauja reikšmingų apribojimų tiek intelektiniame funkcionavime, tiek adaptyviajame elgesyje, prasidėjusių raidos laikotarpiu. Adaptyvusis elgesys apima konceptualius, socialinius ir praktinius įgūdžius, naudojamus kasdieniame gyvenime. Kultūra, kalba, bendruomenės lūkesčiai, stiprybės ir paramos poreikiai taip pat svarbūs.23 Balas apie 70 gali būti svarbi įrodymų dalis; jis nėra savarankiška diagnozė.
Gabumams ir pažangioms galimybėms taip pat reikia sutampančių įrodymų
Aukšti kognityviniai balai gali atskleisti išskirtinį samprotavimo ir mokymosi pajėgumą, kuriam reikia iššūkio. Tačiau griežtas vieno slenksčio naudojimas gali praleisti mokinius, kurių kalba, negalia, švietimo galimybės ar netolygus profilis sumažina sudėtinį balą. Keli matai gali pagerinti ir atradimą, ir planavimą: sričių balai, pasiekimai, portfolio, mokytojų įrodymai, mokymosi greitis ir parodytas kūrybinis darbas gali būti svarbūs pagal konkrečios programos tikslą.
Atranka ir darbas
Kai kognityviniai testai naudojami darbuotojų atrankoje, matuojami gebėjimai turi būti aiškiai susiję su darbu, procedūros turi atitikti taikytiną teisę, o neigiamas poveikis – būti tiriamas. Grupinio lygmens prognozinė koreliacija neatleidžia organizacijos nuo prieinamumo, teisingumo, privatumo, skaidrumo ar žmogaus atliekamos peržiūros.
Neleiskite ribiniam skaičiui apsimesti gamtos dėsniu
Administraciniai slenksčiai yra žmonių sprendimai, taikomi neapibrėžtiems matavimams. Arti slenksčio nedideli sveikatos, normų, testo formos ar matavimo paklaidos pokyčiai gali pakeisti kategoriją. Kuo balas arčiau reikšmingos ribos, tuo svarbesni tampa papildomi įrodymai ir peržiūra.
Papildomi vertinimai atsako į skirtingus klausimus
Atsakymas į nepilną matą nėra dar miglotesnis „viso žmogaus balas“. Atsakymas – tikslingas matų rinkinys, kuriame kiekvienas naudojamas tam konstruktui, kurį gali validžiai nušviesti.
Зберігайте різні показники окремо
Різні докази мають залишатися різними. Когнітивні здібності, навчальні досягнення, виконавчі функції, адаптивна поведінка, креативність, емоційні навички та продемонстрована робота не є взаємозамінними складниками, які слід усереднювати в одне велике число. Панель приладів зберігає значення кожного результату – і виявляє ціннісні рішення, що лежать в основі остаточного вибору.
| Метод | Найкраще запитання | Важливе обмеження |
|---|---|---|
| Оцінювання навчальних досягнень | Які знання або навички ця людина опанувала в читанні, математиці, природничих науках чи іншій сфері? | Відображає навчальну програму, інструкції, мову та можливість навчатися – а не «чисту» здатність. |
| Завдання та шкали оцінювання виконавчих функцій | Як людина гальмує реакцію, перемикається, утримує мету та опрацьовує робочу інформацію під час виконання завдань або в повсякденному житті? | Короткі лабораторні завдання та оцінювання в реальному житті часто охоплюють різні аспекти, і їх не слід вважати еквівалентними.25 |
| Шкали адаптивної поведінки | Наскільки самостійно й ефективно людина використовує концептуальні, соціальні та практичні навички у повсякденному житті? | Оцінки залежать від можливостей, контексту, очікувань та інформантів; корисно використовувати кілька джерел. |
| Динамічне оцінювання | Як змінюється результат після отримання підказок, навчання або структурованої допомоги? | Проведення триває довше й є менш стандартизованим; покращення може бути специфічним для завдання та залежати від оцінювача.26 |
| Оцінювання креативності | Чи може людина генерувати, оцінювати та вдосконалювати оригінальні й ефективні ідеї у визначеній сфері? | Завдання на дивергентне мислення дають приклад творчого потенціалу, а не відображають усе творче життя чи майбутні досягнення. |
| Показники емоційних здібностей | Наскільки добре людина сприймає, розуміє або контролює емоційну інформацію – або як вона описує свої типові емоційні схильності? | Тести здібностей, шкали самооцінки рис і змішані моделі «EQ» вимірюють різні конструкти. |
| Портфоліо та приклади робіт | Що людина насправді написала, спроєктувала, створила, виконала або розв’язала за певний час? | Вибір методів, консультування, ресурси та рішення оцінювача можуть впливати на результат; допомагають спільні критерії та кілька прикладів. |
Виконавчі функції: результат виконання завдань і щоденна саморегуляція
Виконавчі функції охоплюють окремі, але пов’язані аспекти цілеспрямованого контролю, які часто описують через гальмування, перемикання та оновлення робочої пам’яті. Виконання завдань може показати обробку інформації в контрольованих умовах; самооцінки, оцінки батьків або вчителів можуть показати успішність у щоденному досягненні цілей. Невеликий збіг між цими методами означає, що розбіжність є інформативною, а не обов’язково помилкою: методи можуть брати вибірки з різних рівнів поведінки.2425
Динамічне оцінювання: спостерігайте за навчанням, а не лише за початковою точкою
Процедури тестування - навчання - повторного тестування та поступові підказки досліджують, як учень реагує на допомогу. Це може виявити стратегії, корисні види підтримки й гнучкість навчання, яких статичний бал не показує. Це особливо корисно, коли попередні можливості, мова або навчання ускладнюють інтерпретацію. Докази різняться залежно від методу та популяції, тому динамічне оцінювання доповнює стандартизовані докази, а не усуває упередженість.
Креативність: оригінальність разом з ефективністю
Креативність - це не просто багато незвичних відповідей. У серйозному оцінюванні ідеї також мають бути корисними, ефективними або доречними для конкретної сфери. Можна поєднувати відкриті завдання, реальні продукти, портфоліо, експертні оцінки та історію творчої діяльності. Когнітивні здібності й творчі досягнення позитивно пов’язані, але далеко не тотожні - саме тому обидва можуть надати додаткову інформацію.2728
Емоційний інтелект: назвіть конкретну модель
ЕІ здібностей
Завдання на виконання, призначені для оцінювання здатності сприймати, використовувати, розуміти або регулювати емоційну інформацію.
Рисова ЕІ
Типові тенденції та самосприйняття у сфері емоцій, що ґрунтуються на самооцінюванні.
Змішані моделі
Ширші поєднання здібностей, особистості, мотивації та соціальної поведінки, які часто рекламують під одним ярликом EQ.
Ці родини моделей не слід порівнювати так, ніби вони є однією шкалою. Емоційні навички можуть сприяти стосункам, навчанню та результативності, тоді як когнітивні здібності вимірюють інше. Докази свідчать про слабкий зв’язок між показниками ЕІ та академічними результатами, а додаткова прогностична цінність понад когнітивні здібності й особистість залежить від використаного інструмента.2930
Теорія множинного інтелекту: гуманна підказка, але не валідована діагностична карта
Система Говарда Ґарднера спонукала педагогів помічати музичні, тілесні, міжособистісні, просторові та інші здібності, які вузька рутина класу надто часто ігнорує. Це освітнє послання може бути цінним. Однак докази не підтверджують запропоновані інтелекти як незалежні психометричні системи, а популярні онлайн-«тести МІ» не повинні ув’язнювати дітей у ярликах стилів навчання. Використовуйте систему для розширення можливостей, а не для заміни валідованого когнітивного чи навичкового оцінювання.31
IQ оцінює широку й корисну модель когнітивного виконання. Досягнення показують набуту майстерність; показники виконавчих функцій - контроль; адаптивні шкали - повсякденне функціонування; динамічне оцінювання - реакцію на навчання; показники креативності та емоцій - інші здібності; портфоліо - те, що людина насправді створила або зробила.
Чи можуть інтелект - і IQ - зростати?
Так - але це різні твердження. Когнітивні здібності можуть розвиватися, а нормований за віком IQ може змінюватися. Щоб продемонструвати стійке широке зростання, потрібно більше, ніж дозрівання, похибка вимірювання, змінені норми або ефект знайомого тесту.
Зростання заслуговує на святкування
Коли люди розширюють знання, навчаються міркувати над незнайомими проблемами, удосконалюють стратегії запам’ятовування або набувають когнітивних інструментів для швидшого й точнішого розуміння світу, користь може переноситися на освіту, роботу, ухвалення рішень, стосунки та самостійність.
Вимірювання має допомагати визнавати це досягнення, а не заперечувати його лише тому, що інтелект частково стабільний, і не перебільшувати його лише тому, що зріс один натренований показник.
Освіта має найпереконливіші докази широкого впливу
Великий метааналіз, у якому особливу увагу приділили квазіекспериментальним дизайнам, виявив, що додатковий один рік освіти в середньому давав приблизно 1–5 балів IQ користі, залежно від дизайну та припущень, серед більш ніж 600 000 учасників. Ефект проявлявся в різних широких когнітивних категоріях і протягом усього життя.15
Це оцінка популяції, а не щорічна обіцянка для кожної людини і не необмежений лінійний закон. Проте це сильний доказ проти погляду, що виміряний інтелект є незмінним.
Стабільність і зміни не суперечать одне одному
Когнітивні здібності від дитинства до дорослості демонструють зростання рангової стабільності: люди часто зберігають подібне місце серед однолітків. Це не означає, що абсолютний результат ніколи не змінюється, що середовище не має значення або що середнє значення групи не може зміститися. Найповніший новітній метааналіз продемонстрував значну - хоча й не ідеальну - стабільність від пізнього підліткового віку протягом значної частини дорослого життя.19
Бали популяцій змінювалися від покоління до покоління
Протягом значної частини XX століття результати багатьох тестів інтелекту зростали - це ефект Флінна. Метааналіз, що охопив 31 країну, виявив зростання, яке відрізнялося залежно від когнітивної сфери, місця та періоду, а в новіші десятиліття тенденції послабилися.16 Саме тому тести потрібно періодично перенормовувати. Це не означає, що кожне наступне покоління мудріше в усіх сенсах, і не існує універсальної поправки «три бали за десятиліття» для кожного результату.
| Тип покращення | Що змінилося | Найкращий доказ |
|---|---|---|
| Покращення внаслідок практики | Результат у завданнях, що повторюються або є дуже схожими. | Корисно для опанування конкретного завдання; без додаткових доказів не робіть висновку про широке перенесення. |
| Покращення навички | Розвинена сфера, наприклад арифметика, словниковий запас, просторова стратегія або навичка концентрації. | Nepraktikuoto to paties įgūdžio matas ir ilgalaikis realaus gyvenimo rezultatas. |
| Широке когнітивне покращення | Здібності переносяться на суттєво відмінні завдання або сфери. | Альтернативні показники, активні контрольні групи, коли це можливо, і спостереження впродовж часу. |
| Зміна нормативного IQ | Змінюється позиція щодо однолітків тієї самої вікової групи. | Порівнювані та поточні норми; довірчі інтервали; дані про надійні зміни та повторне тестування. |
Тренування мозку: оцінюйте реальне покращення й називайте його точно
Комерційні когнітивні тренування часто покращують виконання практикованого завдання та іноді дуже подібних завдань. Віддалене перенесення на загальний інтелект у добре контрольованих оглядах зазвичай є слабким або непослідовним.18 Покращення в конкретній сфері все одно може бути корисним. Точність зберігає прогрес: якщо кожне покращення називати «вищим IQ», справжнє зростання стає важче розпізнати.
Умови, що підтримують навчання та когнітивне функціонування
Навчайтеся глибоко
Створюйте знання, неодноразово відтворюйте їх, пояснюйте, пов’язуйте та використовуйте для нових проблем.
Бережіть мозок
Надавайте перевагу сну, фізичному здоров’ю, руху, харчуванню, безпеці та лікуванню перешкод для уваги чи навчання.
Шукайте виклик
Працюйте трохи вище за свій поточний рівень майстерності, використовуючи зворотний зв’язок, поступову підтримку й достатньо часу для закріплення.
Відстежуйте перенесення
Шукайте стійке покращення в нових завданнях, реальній роботі та повсякденному розумінні - не лише у знайомій вправі.
Гени впливають на когнітивні відмінності, однак успадковуваність є статистикою популяції в конкретному діапазоні середовищ; це не відсоток інтелекту однієї людини, «спричинений генами», і не доказ того, що освіта не працює.2 Стабільність описує модель. Вона не означає, що зростання неможливе.
Наодинці може сформуватися ідея; спільнота може допомогти їй жити
Оригінальна думка й соціальний зв’язок не є ворогами. Часто вони належать до різних етапів одного творчого циклу.
Захищене блукання
Час наодинці може звільнити увагу від безпосередніх інструкцій, групових очікувань і тиску необхідності реагувати. Людина може простежити дивне запитання, терпіти незавершену думку й поєднувати ідеї ще до того, як хтось інший визначить завдання.
Генерування ідей у групах, що відбувається одночасно, може обмежуватися блокуванням генерування ідей - очікуванням, доки можна буде говорити, через що думка тим часом зникає, - а також страхом оцінювання чи зменшенням індивідуального внеску.32 Ранні приклади інших також можуть спричинити колективну фіксацію, звужуючи досліджуваний діапазон ще до того, як встигне сформуватися оригінальна думка.35
Обране повернення
Коли ідея вже достатньо сформувалася, щоб нею можна було поділитися, інші люди часто стають цінними, а іноді й незамінними для її перевірки, розвитку та поширення. Вони можуть поставити під сумнів припущення, принести знання, випробувати роботу, надати ресурси, вдосконалити комунікацію, відкрити двері та захистити творця від сліпих зон. У трьох контрольованих експериментах із написання ідей чергування індивідуальних і групових сесій породило більше ідей, ніж безперервна робота лише в одному режимі, - це свідчення на користь гнучкого циклу в лабораторній генерації ідей, а не доказ існування одного універсально найкращого середовища для всієї творчої роботи.33
Повернення за власним бажанням може стати святом: приватна іскра зустрічається з визнанням, підтримкою та спільними зусиллями. Розум не мусить залишатися на самоті, щоб зберігати оригінальність.
Дайте оригінальності достатньо усамітнення, щоб сформуватися, - і достатньо спільноти, щоб зростати, розвиватися, отримувати підтримку та бути відзначеною.
Жоден етап не має перетворюватися на наказ. Усамі́тнення може стати ізоляцією; співпраця - конформізмом. Дехто найкраще мислить у діалозі, інші - у тиші, а багато хто чергує обидва способи. Здорова модель є гнучкою: відходьте без сорому, коли безперешкодній думці потрібен захист, і повертайтеся без сорому, коли прагнете взаємозв’язку, критики та спільної творчості.
Коли розуми захищені від приниження, примусу та постійних переривань, люди можуть підтримувати інтелектуальне зростання одне одного, не стираючи відмінностей. Інтелект стає чимось більшим за особисту перевагу: він стає здатністю, якою діляться через навчання, винаходи, турботу, чесні розбіжності та спільне розв’язання проблем.
Вибір оцінювання - і підготовка до нього
Почніть із рішення, яке потрібно вдосконалити. Абстрактно «найкращий тест» може бути непридатним для конкретної людини, запитання чи юрисдикції.
Визначте мету
Клінічне діагностування, освітнє планування, визначення обдарованості, підтримка людей з інвалідністю, наукові дослідження та особиста цікавість потребують різних доказів і рівня точності.
Узгодьте з людиною
Перевірте вік, мову, культурний контекст, сенсорну й моторну доступність, комунікаційні потреби, цифровий досвід і репрезентативність норм.
Узгодьте з рішенням
Запитайте, чи обґрунтовують керівництво до тесту та незалежні стандарти саме таку інтерпретацію і чи потрібні додаткові докази.
Перед сесією
- Для інтерпретації, що має клінічні, освітні чи інші важливі наслідки, залучіть кваліфікованого фахівця.
- Повідомте про важливі відомості щодо мовної історії, освіти, діагнозів, ліків, адаптацій і попереднього тестування.
- Запитайте, які конструкти, бали та порівняльні групи використовує обрана батарея тестів.
- Зберігайте звичний режим сну, харчування, призначене лікування та сенсорні допоміжні засоби; не вдавайтеся до «підготовки IQ» в останню хвилину.
- Повідомте про незвичне нездужання, біль, сильний стрес або перешкоди, щоб за потреби можна було розглянути перенесення тестування.
Під час сесії
Намагайтеся бути щирими, запитуйте, якщо інструкції незрозумілі, і повідомляйте про перешкоди доступності. Не шукайте витоків завдань і не вивчайте захищений зміст тесту: це порушує значення результату. Звичайна знайомість із головоломками є частиною життя; підготовка за захищеними запитаннями конкретного тесту змінює висновок, який може обґрунтувати бал.
Після сесії: запитання, які варто поставити
- Яким був складений бал і його довірчий інтервал?
- Які відмінності профілю є надійними, рідкісними та практично значущими?
- Які умови тестування могли вплинути на результат?
- Наскільки добре результати відповідали історії та іншим доказам?
- Чого тест не вимірює?
- Які рішення ці бали обґрунтовано можуть допомогти прийняти?
- Який виклик, підтримка або подальше оцінювання мають бути наступними?
- Коли було б корисно пройти тест повторно і як буде враховано ефект практики?
Особиста допитливість також заслуговує на контекст
Надійне оцінювання може дати цінні знання про себе. Розглядайте число як одну координату, а потім запитайте, що воно допомагає зробити: обрати відповідний виклик, розвинути слабші здібності, відповідально використовувати сильні сторони й продовжувати навчатися. Прагнення до малих відмінностей у балах може замінити розвиток тривогою через вимірювання.
Швидше тестування не повинно означати слабших доказів
Адаптивні платформи, дані процесу та штучний інтелект можуть покращити вимірювання - однак ефективність не є валідністю, а прогноз не є розумінням.
Комп’ютеризоване адаптивне тестування
Алгоритм обирає наступне завдання з каліброваної бази на основі попередніх відповідей. Це дає змогу досягти подібної точності з меншою кількістю завдань, однак це метод подання - а не нова форма інтелекту.
Дані процесу
Час, виправлення, зміни стратегій і послідовності відповідей можуть показати, як було знайдено рішення. Ці сигнали потребують незалежної валідації; крім того, вони можуть включати технологічні або моторні вимоги.
Інтерпретація за допомогою ШІ
Системи можуть виявляти закономірності, готувати чернетки звітів або пропонувати гіпотези. Вони не повинні приховувати невизначеність, вигадувати діагнози, відтворювати упередженість навчальних даних або замінювати відповідальне професійне судження.
Що відповідальна інновація має зробити видимим
- Конструкт: що саме робить висновок про спостережувану поведінку.
- Дані для навчання та норми: кого представлено, кого бракує та коли дані було зібрано.
- Невизначеність: точність у різних діапазонах балів, підгрупах і порогах прийняття рішень.
- Справедливість: функціонування завдань, доступність, диференційне прогнозування та подальші помилки.
- Конфіденційність: які чутливі когнітивні дані та дані про поведінку зберігаються, пов’язуються, утримуються або передаються.
- Підзвітність: хто може пояснити, оскаржити та виправити результат, що має важливі наслідки.
Більша кількість поведінкових даних одночасно може створити детальнішу модель і більший ризик для приватності. Голос, натискання клавіш, погляд, час затримки та моделі взаємодії можуть розкривати інформацію про інвалідність, стан здоров'я чи ідентичність, не пов'язану із заявленою метою. Тому мінімізація даних, інформована згода, безпека та реальна можливість оскарження мають бути інтегровані в дизайн тесту - а не приховані в останньому абзаці, який ніхто не читає.
Стандарт майбутнього
Краще оцінювання - це не те, що створює найбільше чисел. Воно відповідає на важливе запитання з достатньою точністю, створює менше непотрібного тягаря, розкриває власні обмеження та веде до кращих можливостей або підтримки.
Поширені міфи - виправлено
Більшість суперечок про IQ стає зрозумілішою, якщо абсолютне твердження замінити обмеженим і точним.
Išvada: matuokite tai, kas svarbu, tada padėkite tam augti
IQ testavimas nėra nei nuosprendis, nei iliuzija. Gerai sukurtas ir tinkamai normuotas vertinimas gali pateikti naudingą bendrųjų ir specifinių kognityvinių gebėjimų įvertį. Šie gebėjimai svarbūs: jie palaiko greitesnį mokymąsi, gilesnį supratimą, lankstų samprotavimą ir gebėjimą spręsti vis sudėtingesnes problemas.
Įvertis vis tiek išlieka sąlyginis. Jis turi neapibrėžtumą, atspindi konkretų elgesio pavyzdį ir negali savyje sutalpinti viso žmogaus. Teisingam naudojimui reikia tinkamų normų, prieinamo administravimo, numatomą interpretaciją pagrindžiančių įrodymų ir santūrumo, kai pasekmės didelės. Papildomi vertinimai turėtų praplėsti vaizdą neapsimetant, kad visi vertingi gebėjimai yra vienas paslėptas skaičius.
Svarbiausia – matavimas turi tarnauti raidai. Švietimas gali stiprinti kognityvinį rezultatą; sveikata ir saugumas saugo smegenis; iššūkis, grįžtamasis ryšys ir praktika kuria žinias ir įgūdžius; vienatvė gali apsaugoti originalią mintį; bendruomenė gali padėti jai subręsti ir pasiekti pasaulį. Švęskite patvarų kognityvinį augimą – ir patvirtintą IQ padidėjimą, kai įvertinti perkėlimas, išliekamumas, praktikos efektas ir matavimo paklaida – tada naudokite didesnį gebėjimą supratimui gilinti, galimybėms plėsti ir gyvenimams gerinti.
Atsargiai matuokite intelektą, padėkite jam augti ir saugokite žmones, kuriuose jis gyvena. Švęskite išskirtinius gebėjimus, viso gyvenimo mokymąsi, originalią mintį ir sukauptą išmintį. Suteikite išugdytam protui sveikatą, laisvę, vienatvę, bendruomenę, iššūkį ir pagarbą, kurių jam reikia – nes kai toks protas apleidžiamas ar prarandamas, žmonija gali prarasti orientaciją, supratimą ir galimybes, kurių joks turtas ar duomenų bazė negali tiesiog pakeisti.
Šaltiniai ir tolesnis skaitymas
Pirminiai standartai, oficialios gairės, istoriniai šaltiniai ir recenzuoti tyrimai, naudoti šiame vadove.
- AERA, APA ir NCME. Švietimo ir psichologinio testavimo standartai (2014).
- Deary, Cox ir Hill. Genetinė įvairovė, smegenys ir intelekto skirtumai. Molecular Psychiatry (2022).
- Brysbaert ir Nicolas. Du atkaklūs mitai apie Binet ir intelekto testų pradžią psichologijos vadovėliuose. Collabra: Psychology (2024).
- Binet & Simon. Розвиток інтелекту в дітей (1908, оригінал французькою мовою).
- Kovacs & Pléh. Вільям Штерн: значення його програми «диференціальної психології» для сучасного вимірювання та дослідження інтелекту. Journal of Intelligence (2023).
- Terman. Вимірювання інтелекту (1916).
- Міністерство оборони США. Історія військового тестування.
- Warne ir kt. Аналіз Стівена Джея Гулда тесту Army Beta у Помилковому вимірюванні людини: викривлення та хибні уявлення щодо новаторського тесту розумових здібностей. Journal of Intelligence (2019); Brigham. Тести інтелекту для груп іммігрантів. Psychological Review (1930).
- Національний інститут дослідження геному людини. Євгеніка та науковий расизм; Snyderman & Herrnstein. Тести інтелекту та Закон про імміграцію 1924 року (1983).
- Boake. Від Біне-Сімона до Векслера-Белв’ю. Journal of Clinical and Experimental Neuropsychology (2002).
- McGrew. Теорія когнітивних здібностей Керролла з трьома рівнями (3S) через 30 років: вплив, уточнення теорії 3S-CHC, структурна реплікація та розширення психометричного мережевого аналізу когнітивних здібностей і навчальних досягнень. Journal of Intelligence (2023).
- Pearson Assessments. Шкала інтелекту Векслера для дорослих, п’яте видання.
- Національні академії. Психологічне тестування для визначення інвалідності (2015).
- Sackett ir kt. Повторний аналіз метааналітичних оцінок валідності під час відбору персоналу: усунення систематичної надмірної корекції через обмеження діапазону. Journal of Applied Psychology (2022).
- Ritchie і Tucker-Drob. Наскільки освіта підвищує інтелект? Метааналіз. Психологічна наука (2018).
- Pietschnig і Voracek. Століття глобального зростання IQ: формальний метааналіз ефекту Флінна. Перспективи психологічної науки (2015).
- Scharfen, Peters і Holling. Ефекти повторного тестування в тестах когнітивних здібностей: метааналіз. Інтелект (2018).
- Simons та ін. Чи працюють програми «тренування мозку»? Психологічна наука в суспільних інтересах (2016).
- Breit та ін. Стабільність когнітивних здібностей: метааналітичний огляд лонгітюдних досліджень. Психологічний бюлетень (2024).
- Міжнародна комісія з тестування. Рекомендації ITC щодо перекладу й адаптації тестів (друге видання) (2017).
- Putnick і Bornstein. Умовності та звітність щодо інваріантності вимірювання. Огляд досліджень розвитку (2016).
- Європейська федерація асоціацій психологів. Модель експертизи тестів EFPA, версія 2025 року.
- Американська асоціація з питань інтелектуальних порушень і порушень розвитку. Визначення інтелектуальної недостатності.
- Miyake та ін. Єдність і різноманіття виконавчих функцій. Когнітивна психологія (2000).
- Toplak, West і Stanovich. Показники виконавчих функцій на основі виконання завдань і рейтингового оцінювання. Журнал дитячої психології та психіатрії (2013).
- Swanson і Lussier. Вибірковий синтез експериментальної літератури про динамічне оцінювання. Огляд освітніх досліджень (2001).
- ОЕСР. Рамкова концепція креативного мислення PISA 2022.
- Karwowski та ін. Як результати тестів інтелекту пов’язані з творчими досягненнями? Метааналіз. Journal of Intelligence (2021).
- O’Connor та ін. Вимірювання емоційного інтелекту: критичний огляд літератури та рекомендації для дослідників і практиків. Frontiers in Psychology (2019).
- MacCann та ін. Емоційний інтелект прогнозує академічну успішність: метааналіз. Psychological Bulletin (2020).
- Waterhouse. Множинний інтелект, ефект Моцарта та емоційний інтелект: критичний огляд. Educational Psychologist (2006).
- Mullen, Johnson & Salas. Зниження продуктивності в групах мозкового штурму: метааналітичний синтез. Basic and Applied Social Psychology (1991).
- Korde & Paulus. Чергування індивідуального та групового генерування ідей: пошук невловимої синергії. Journal of Experimental Social Psychology (2017).
- Flore & Wicherts. Чи впливає загроза стереотипу на успішність дівчат у стереотипізованих сферах? Метааналіз. Journal of School Psychology (2015).
- Kohn & Smith. Спільна фіксація: вплив ідей інших на мозковий штурм. Applied Cognitive Psychology (2011).
Навчальна примітка та примітка щодо оцінювання: у цій статті наведено загальну інформацію, а не індивідуальний діагноз, інтерпретацію балів, юридичну консультацію чи заміну оцінювання кваліфікованим психологом або іншим належним чином сертифікованим фахівцем. Вибір тестів, адаптації, критерії відповідності та юридичні вимоги відрізняються залежно від місця та мети.
Серія «Вивільнений інтелект»
- Визначення та підходи до інтелекту
- Анатомія та функції мозку
- Типи інтелекту
- Теорії інтелекту
- Нейропластичність і навчання протягом усього життя
- Когнітивний розвиток протягом усього життя
- Генетика та середовище інтелекту
- Вимірювання інтелекту
- Мозкові хвилі та стани свідомості
- Когнітивні функції