BrainTypeIQ
TestTipi cerebraliReportRisorse
Articoli·2026-09-05

Come si valuta la qualità di un test del QI

La qualità di un test del QI non dipende dal fatto che riporti una media di 100, ma dalla standardizzazione, dalle norme di confronto, dall'affidabilità e dalla validità. Le informazioni pubbliche devono permettere di valutare anche l'errore di misurazione e la precisione dei punteggi elevati.

Indice
  1. 01I quattro elementi che determinano la qualità di un test del QI
  2. 02Standardizzazione e norme di riferimento
  3. 03Affidabilità, errore di misurazione e intervallo di confidenza
  4. 04Validità e ampiezza delle abilità misurate
  5. 05Prove e norme necessarie per misurare un QI elevato
  6. 06Le informazioni pubbliche necessarie per valutare la qualità
  7. 07Le basi della misurazione che BrainTypeIQ rende pubbliche
  8. 08Misura il QI e scopri il tuo profilo cognitivo con BrainTypeIQ

Un test può presentarsi come scientifico e preciso e riportare una media di 100, ma questo non basta a stabilire la qualità della sua misurazione. Bisogna sapere con chi viene confrontato il risultato, quali abilità misura e quale margine di errore è associato al risultato.

Se le informazioni necessarie per valutarlo non sono pubbliche, non bisogna considerare il QI prodotto da quel test come un valore preciso. Pubblicità, posizione nei risultati di ricerca, grafica curata e certificati del QI non dimostrano la qualità della misurazione. L'articolo su come scegliere un test del QI online affidabile considera anche prezzi e condizioni contrattuali.

I quattro elementi che determinano la qualità di un test del QI

ElementoChe cosa verificareChe cosa accade se manca
StandardizzazioneSe l'esecuzione e il calcolo dei punteggi avvengono secondo condizioni uniformiLe differenze di dispositivo, tempo o metodo di calcolo si riflettono nel punteggio
NormeCon quali persone viene confrontato il risultatoQI 100 e il 2% più alto non hanno un significato definito
AffidabilitàQuanto il punteggio rimane coerenteRisposte corrette o errate per caso influiscono fortemente sul risultato
ValiditàSe il punteggio può essere interpretato come l'abilità dichiarataUn risultato relativo al ragionamento figurale viene indebitamente generalizzato al QI totale
Scorri orizzontalmente per vedere la tabella

Nessuno di questi quattro elementi basta da solo. Anche con un grande campione normativo, condizioni di esecuzione molto diverse compromettono il confronto. E anche un test molto affidabile non è una misura valida del QI totale se considera soltanto il ragionamento figurale e non misura abilità come linguaggio, memoria e velocità di elaborazione.

Standardizzazione e norme di riferimento

Standardizzare significa mantenere uguali le istruzioni, i limiti di tempo, la presentazione delle prove, il calcolo dei punteggi e la gestione di interruzioni e risposte date fuori tempo. Online contano anche le differenze di visualizzazione tra smartphone e computer, i ritardi della connessione, i tentativi ripetuti e l'uso di ricerche o appunti. Se due persone con la stessa abilità possono ottenere QI molto diversi soltanto per il dispositivo usato o il numero di tentativi, la scala non consente un confronto valido.

Le norme definiscono con chi viene confrontato il QI. Qualsiasi insieme di dati può essere trasformato in una scala con media 100 e deviazione standard 15. Ma fissare a 100 la media dei soli visitatori di un sito non significa descrivere la posizione di una persona nella popolazione adulta italiana.

Come minimo, bisogna conoscere:

  • non soltanto il numero di persone, ma anche età, lingua, area geografica e metodo di reclutamento;
  • come sono stati gestiti primi tentativi, ripetizioni, risposte anomale e prove interrotte;
  • quante persone erano presenti in ciascuna fascia d'età e come è stata applicata la correzione per età;
  • quando sono stati raccolti i dati e se corrispondono alle prove e al metodo di calcolo attuali;
  • per un test in italiano, se le prove sono state adattate in italiano e le norme sono state costruite su persone che le hanno svolte in italiano.

Anche l'espressione «100.000 partecipanti» dice poco se non si sa se include più tentativi delle stesse persone, quante persone appartengono a ciascuna età e quando sono stati raccolti i dati. Un test semplicemente tradotto in italiano non può usare senza adattamento le norme della versione in un'altra lingua. Nel modello EFPA 2025 per la revisione dei test, norme, affidabilità e validità rientrano tra le informazioni tecniche fondamentali da valutare.

Affidabilità, errore di misurazione e intervallo di confidenza

L'affidabilità esprime con un coefficiente da 0 a 1 quanta informazione coerente contiene il punteggio. La coerenza tra gli item e l'affidabilità test-retest, che misura la stabilità in giorni diversi, rispondono a domande differenti. Non basta quindi dichiarare «affidabilità 0,90»: bisogna indicare il tipo di coefficiente, i dati su cui è stato calcolato e il punteggio a cui si riferisce.

Dall'affidabilità si può calcolare l'errore standard di misurazione, o SEM, del punteggio individuale. Su una scala del QI con deviazione standard 15 e affidabilità 0,90, il SEM è di circa 4,7 punti. Se l'intervallo di confidenza al 95% viene calcolato come ±1,96 SEM, un QI di 130 corrisponde a un intervallo di circa 121–139. Un'affidabilità di 0,90 non significa che il risultato sia preciso al singolo punto.

Questo intervallo quantifica l'incertezza dovuta all'errore di misurazione di un singolo punteggio. Un campione normativo poco rappresentativo o una validità insufficiente, come chiamare QI totale una sola prova di ragionamento figurale, non vengono risolti da un intervallo ristretto.

Validità e ampiezza delle abilità misurate

La validità stabilisce se il punteggio può essere interpretato come la capacità dichiarata. Per valutarla bisogna sapere se il contenuto delle prove copre quell'abilità, se la struttura prevista dei punteggi è confermata dai dati e se le relazioni con test d'intelligenza già esistenti o con compiti collegati vanno nella direzione attesa.

Le matrici e i problemi figurali possono costituire un buon test del ragionamento figurale o fluido. Ma anche se 30 problemi figurali producono un'affidabilità elevata, non significa che siano stati misurati vocabolario, conoscenze, memoria di lavoro e velocità di elaborazione. Per riportare un QI totale servono prove che misurino più abilità e dati che giustifichino la loro combinazione in un punteggio complessivo.

Una «correlazione di 0,70 con un test del QI esistente» non significa neppure una precisione del 70%. La correlazione indica quanto due punteggi aumentano o diminuiscono insieme. Se a ogni risultato si aggiungessero 10 punti, la correlazione con il punteggio originale sarebbe 1, ma tutti i valori sarebbero spostati di 10 punti. Per stabilire se si tratta dello stesso QI servono anche il nome e la versione del test di confronto, il campione, la differenza media e le differenze tra fasce di punteggio.

Prove e norme necessarie per misurare un QI elevato

Per distinguere QI 130 da QI 140 bisogna considerare due limiti nella fascia superiore.

LimiteChe cosa serveChe cosa accade se manca
Limite delle proveItem capaci di distinguere anche tra persone con abilità elevateLe persone più capaci rispondono correttamente a quasi tutto e le differenze non sono più osservabili
Limite delle normeDati sufficienti nelle fasce alte e un metodo adeguato di conversioneNon si possono stimare in modo stabile valori dettagliati a partire dallo stesso punteggio grezzo
Scorri orizzontalmente per vedere la tabella

Anche in un campione numeroso, le persone agli estremi della distribuzione sono poche. Assumendo una distribuzione normale con media 100 e deviazione standard 15, un campione di 2.000 persone comprende circa 8 persone con QI 140 o superiore. Sono troppo poche per distinguere con precisione QI 140, 142 e 145. La tabella su QI e quota della popolazione mostra perché i dati necessari diventano più difficili da raccogliere all'aumentare del punteggio.

Nel campione normativo standard della WISC-V, composto da 2.200 persone, soltanto 16 bambini avevano ottenuto almeno un punteggio composito pari o superiore a 150. Per questo sono state create norme estese per la fascia alta, verificate anche su un campione separato di 108 bambini con abilità elevate. Anche un test affermato ha bisogno di prove e dati specifici per misurare con precisione l'estremo superiore.

Le informazioni pubbliche necessarie per valutare la qualità

Nelle informazioni pubbliche bisogna cercare la corrispondenza tra ciò che viene dichiarato e i dati che permettono di valutarlo.

DichiarazioneInformazioni necessarie per valutarla
QI 100 o 2% più altoPopolazione di riferimento, composizione del campione, anno di raccolta e metodo di conversione
QI totaleAbilità misurate, struttura delle prove e struttura dei punteggi
Affidabilità 0,90Tipo di coefficiente, campione analizzato, SEM e precisione nelle diverse fasce di punteggio
Correlazione elevata con un test esistenteNome e versione del test, campione, correlazione e differenza media
Misurazione anche oltre QI 140Prove per le abilità elevate, numero di persone nella fascia superiore, estrapolazione e metodo di verifica
Scientifico o precisoMetodo e risultati che sostengono ciascuna affermazione
Scorri orizzontalmente per vedere la tabella

Non è necessario pubblicare tutti i dati grezzi, l'algoritmo di calcolo o le prove effettive. Se sono disponibili informazioni sulla popolazione, sul campione, sulle condizioni di esecuzione, sul metodo di conversione, sull'affidabilità e sull'errore, sui principali risultati di validità e sulla corrispondenza tra documentazione tecnica e versione attuale, chi usa il test può valutarne le affermazioni.

Se queste informazioni non sono disponibili, un valore dettagliato come QI 137 ha un significato e una precisione che non possono essere verificati. Non bisogna considerare preciso il QI di un test che non pubblica le proprie basi. Questa è la conclusione pratica.

Le basi della misurazione che BrainTypeIQ rende pubbliche

BrainTypeIQ spiega perché usa 9 prove e come le collega a 5 aree, come costruisce il QI totale e le 5 aree dalle 9 prove e come converte e combina i punteggi. Pubblica inoltre la taratura della versione giapponese sui primi 841 completamenti e l'affidabilità del QI totale pari a 0,929, con un SEM di circa 4,0 punti. Se l'obiettivo è una valutazione formale o una relazione da presentare a terzi, bisogna scegliere in base alla differenza di ruolo tra WAIS e test del QI online, anziché confrontare soltanto la qualità dei test online.

Articoli correlati

Perché misurare il QI›ADHD, autismo e test del QI negli adulti›Si può fare la WAIS online e gratis?›

Misura il QI e le differenze nel profilo cognitivo

Con un test del QI online di 9 prove, della durata di circa 30 minuti, puoi vedere il QI totale e il report sul tipo cerebrale.

Inizia il test del QI gratis
← Articoli