IQ z testu, který nezveřejňuje podklady potřebné k posouzení, nepovažujte za přesné číslo. Reklama, pořadí ve vyhledávání, hezky zpracovaná výsledková stránka ani certifikát IQ nejsou důkazem kvalitního měření. Výběr včetně cen a smluvních podmínek popisuje článek Jak vybrat spolehlivý online IQ test.
Čtyři složky kvality měření IQ
| Složka | Co je třeba doložit | Co se stane, pokud chybí |
|---|---|---|
| Standardizace | Jednotné podmínky zadávání a skórování | Do skóre se promítají rozdíly zařízení, času nebo způsobu hodnocení |
| Normy | S čími údaji se výsledek porovnává | Není jasné, co znamená IQ 100 nebo horní 2 % |
| Reliabilita | Nakolik je skóre konzistentní | Náhodná správná či chybná odpověď může číslem výrazně pohnout |
| Validita | Zda lze skóre vykládat jako uvedenou schopnost | Výsledek z obrazcového uvažování se neoprávněně rozšíří na celkové IQ |
Kvalitu měření nelze posoudit podle jediné z těchto čtyř složek. Například i vysoce reliabilní test, který měří pouze uvažování s obrazci, není validním měřením celkového IQ zahrnujícího také jazyk, paměť a rychlost zpracování.
Standardizace a normy
Standardizace znamená sjednotit instrukce, časové limity, zadávání úloh, skórování i postup při vypršení času nebo přerušení. Online k podmínkám měření patří také rozdíly zobrazení na telefonu a počítači, zpoždění připojení, opakované absolvování testu a pravidla pro vyhledávání či poznámky. Pokud lidem se stejnými schopnostmi vyjde výrazně odlišné IQ jen kvůli zařízení nebo počtu pokusů, nevzniká srovnatelná škála.
Normy určují, s kým se vaše IQ porovnává. Převést počet správných odpovědí na průměr 100 a směrodatnou odchylku 15 lze z údajů jakékoli skupiny. Nastavení průměru návštěvníků webu na 100 však ještě neukazuje postavení mezi dospělými v obecné populaci.
U norem záleží nejen na počtu lidí, ale také na věku, jazyce, regionu a způsobu náboru. Důležité je i zacházení s opakovanými pokusy, neobvyklými odpověďmi a nedokončenými testy, věková korekce, rok sběru a návaznost na současné úlohy a skórování.
Ani údaj „100 000 účastníků“ neumožňuje posoudit normy, pokud není jasné, zda zahrnuje opakované pokusy stejných lidí, kolik účastníků je v jednotlivých věkových skupinách a kdy se data sbírala. Pouhý překlad testu do češtiny také nestačí k převzetí norem z cizojazyčné verze. Například základní standardy Japonské společnosti pro testování vyžadují dokumentování a zveřejnění referenční populace, výběrového souboru, standardizačních postupů a statistických údajů.
Reliabilita, chyba měření a interval spolehlivosti
Reliabilita vyjadřuje koeficientem od 0 do 1, kolik konzistentní informace skóre obsahuje. Vnitřní konzistence položek a test–retest reliabilita, která sleduje stabilitu při opakování v jiný den, odpovídají na odlišné otázky. Nestačí proto napsat „reliabilita 0,90“. Je potřeba uvést její druh, použitý soubor a skóre, pro které byla vypočtena.
Z reliability lze vypočítat standardní chybu měření (SEM) individuálního skóre. Na IQ škále se směrodatnou odchylkou 15 odpovídá reliabilitě 0,90 SEM přibližně 4,7 bodu. Při výpočtu 95% intervalu spolehlivosti jako ±1,96 SEM vychází pro IQ 130 přibližné rozmezí 121–139. Reliabilita 0,90 neznamená přesnost na jeden bod.
Toto rozmezí vyjadřuje chybu měření obsaženou v jednom individuálním skóre. Úzký interval spolehlivosti neřeší zkreslení normovacího souboru ani otázku validity: zda je oprávněné nazývat výsledek obrazcového uvažování celkovým IQ.
Validita a rozsah měřených schopností
Validita rozhoduje o tom, zda lze skóre vykládat jako schopnost, jejíž název je u něj uveden. Posuzuje se pokrytí schopnosti obsahem úloh, ověření předpokládané struktury skóre v datech a očekávané vztahy s existujícími inteligenčními testy či souvisejícími úlohami.
Obrazcové úlohy a maticové uvažování mohou být kvalitními testy obrazcového nebo fluidního uvažování. Ani vysoká reliabilita třiceti obrazcových úloh však neznamená, že test změřil slovní zásobu, znalosti, pracovní paměť a rychlost zpracování. Označení „celkové IQ“ vyžaduje úlohy měřící více schopností a podklady pro jejich spojení do celkového skóre.
Ani „korelace 0,70 s existujícím IQ testem“ neznamená 70% přesnost. Korelace vyjadřuje, nakolik dvě skóre společně stoupají a klesají. Kdybychom každému přičetli 10 bodů, korelace s původním skóre by byla 1, ale všichni by měli výsledek o 10 bodů posunutý. Bez názvu a verze srovnávacího testu, popisu souboru, průměrného rozdílu a rozdílů v jednotlivých pásmech nelze rozhodnout, zda obě čísla znamenají stejné IQ.
Pro měření vysokého IQ jsou potřeba náročné úlohy i odpovídající normy
Rozlišení IQ 130 a 140 vyžaduje překonat dva stropy.
| Strop | Co je potřeba | Co způsobí nedostatek |
|---|---|---|
| Strop úloh | Úlohy, které rozliší i lidi s vysokými schopnostmi | Nejlepší účastníci zodpovědí téměř vše správně a rozdíly schopností nejsou pozorovatelné |
| Strop norem | Dostatek údajů a vhodný převod pro vysoké pásmo skóre | Ze stejného počtu správných odpovědí nelze stabilně odhadovat jemné rozdíly IQ |
Ani ve velkém souboru není na okrajích rozdělení mnoho lidí. Při normálním rozdělení s průměrem 100 a směrodatnou odchylkou 15 připadá na soubor 2 000 lidí přibližně 8 osob s IQ alespoň 140. Z toho nelze spolehlivě jemně rozlišovat IQ 140, 142 a 145. Vztah IQ a podílu populace ukazuje, proč je s rostoucím skóre obtížnější získat potřebná data.
V běžném normovacím souboru WISC-V o 2 200 dětech dosáhlo některého složeného skóre 150 nebo vyššího pouze 16 dětí. Proto vznikly rozšířené normy pro vysoká skóre, ověřené také na samostatném souboru 108 dětí s vysokými schopnostmi. I zavedené testy potřebují pro horní pásmo zvlášť navržené úlohy a data.
Jaké zveřejněné informace umožňují posoudit kvalitu
U zveřejněných podkladů záleží na tom, co dokládají, nikoli na reklamních heslech.
| Co chcete posoudit | Potřebné informace |
|---|---|
| S kým se výsledek porovnává | Cílová populace, složení souboru, rok sběru, způsob převodu |
| Jakou schopnost číslo měří | Skladba úloh, struktura skóre, metody a výsledky ověření validity |
| Jak velkou chybu číslo obsahuje | Podmínky provedení, druh reliability, SEM, ověření vysokého pásma skóre |
Není nutné zveřejnit veškerá surová data, celý skórovací algoritmus ani skutečné testové úlohy. Pro posouzení tvrzení stačí srozumitelně popsat cílovou skupinu, soubor, podmínky provedení, převod skóre, reliabilitu a chybu měření, hlavní výsledky validity a vztah technických podkladů k aktuální verzi.
Pokud takové podklady chybějí, nelze ověřit význam ani přesnost výsledku, přestože se zobrazí zdánlivě jemné číslo jako IQ 137. IQ z testu, který nezveřejňuje své podklady, nepovažujte za přesné číslo. To je praktický závěr.
Jaké podklady k měření zveřejňuje BrainTypeIQ
BrainTypeIQ vysvětluje výběr 9 subtestů a jejich přiřazení k 5 oblastem i sestavení celkového IQ a 5 oblastí z těchto subtestů.
Zveřejňuje také převod na standardní skóre a jejich skládání, normy japonské verze založené na výsledcích 841 lidí při prvním dokončení testu a reliabilitu celkového IQ 0,929 se SEM přibližně 4,0 bodu. Pokud potřebujete odborné posouzení nebo výsledek pro jinou instituci, výběr začíná u odlišných účelů WAIS a online IQ testů.