Die Reliabilität des Gesamt-IQ beträgt 0,929
Für die japanische Version wurden aus mehr als 2.000 Abschlüssen 841 qualitätsgeprüfte Erstteilnehmende analysiert.
| Kennwert | Schätzung | 95-%-Konfidenzintervall | Bedeutung |
|---|---|---|---|
| zusammengesetzte Reliabilität des Gesamt-IQ | 0,929 | 0,924–0,932 | Präzision der Zusammenfassung aus neun Testteilen |
| Omega hierarchisch des allgemeinen Faktors | 0,834 | 0,815–0,852 | gemeinsamer allgemeiner Anteil der neun Testteile |
| standardisiertes Cronbachs Alpha | 0,845 | 0,828–0,860 | Konsistenz über alle neun Testteile |
Aus 0,929 ergibt sich ein Standardmessfehler (SEM) von etwa 4,0 IQ-Punkten. Das bedeutet weder, dass jeder Wert sicher um vier Punkte schwankt, noch dass der wahre Wert zwingend innerhalb von plus oder minus vier Punkten liegt. Es zeigt, warum Unterschiede von einem einzelnen Punkt nicht als exakt behandelt werden sollten.
Das Ergebnis wiederholte sich in zwei zeitlichen Hälften
| Daten | standardisiertes Alpha der neun Testteile |
|---|---|
| erste 420 Personen | 0,844 |
| spätere 421 Personen | 0,846 |
| alle 841 Personen | 0,845 |
Die nahezu gleichen Werte zeigen, dass die zentrale Konsistenz nicht nur in einer bestimmten Teilnahmephase auftrat. Dieselben 841 Personen bilden auch die japanische Normierungsanalyse.
Die fünf Bereichsscores sind weniger präzise als der Gesamt-IQ
| Bereich | Testteile | geschätzte Reliabilität |
|---|---|---|
| Gc | Wortschatz, verbale Analogien | 0,852 |
| Gf | Matrizen, Waagenlogik | 0,834 |
| Gv | Papierfalten, Zusammensetz-Puzzles | 0,789 |
| Gwm | Rechenspanne, visuelle Umkehrung | 0,726 |
| Gs | Symbolsuche | 0,734 |
Der Gesamt-IQ bündelt neun Testteile und ist deshalb stabiler als Bereiche aus ein oder zwei Testteilen. Bereichsunterschiede sollten nach ihrer Größe, der geringeren Präzision und ihrer Übereinstimmung mit dem Alltag gelesen werden, nicht anhand weniger Punkte.
Der Kennwert berücksichtigt die tatsächliche Testlogik
Einige Testteile enden abhängig vom Leistungsverlauf, andere erfassen die Zahl korrekter Bearbeitungen in begrenzter Zeit. Die Schätzung berücksichtigt diese unterschiedlichen Aufgabenmodelle. Der Wert 0,929 ist keine Test-Retest-Korrelation und keine Übereinstimmung mit der WAIS.
Reliabilität beschreibt konsistente Messinformation. Normierung bestimmt die Vergleichsgruppe; Validität betrifft die zulässige Bedeutung eines Ergebnisses. Für andere Sprachversionen wird die japanische Reliabilität als produktspezifische Evidenz der japanischen Fassung ausgewiesen, nicht als bereits nachgewiesener Kennwert der jeweiligen Sprachversion.