Na versão japonesa do BrainTypeIQ, a análise com 841 pessoas apontou uma confiabilidade de 0,929 para o QI total e um erro padrão de medição (SEM) de aproximadamente 4,0 pontos. Como reúne as 9 tarefas, o QI total é mais estável do que cada um dos 5 domínios isoladamente.
A confiabilidade do QI total foi de 0,929, com SEM de aproximadamente 4,0 pontos
Depois de verificar a qualidade das respostas, as novas tentativas e as condições de aplicação e pontuação em mais de 2.000 registros de testes concluídos em japonês, a análise considerou 841 pessoas que concluíram pela primeira vez as 9 tarefas atuais sob as mesmas condições.
| Indicador | Resultado | O que significa ao ler a pontuação |
|---|---|---|
| Confiabilidade composta do QI total | 0,929 | Precisão da pontuação que reúne as 9 tarefas |
| Erro padrão de medição, SEM | Aproximadamente 4,0 pontos | Tamanho do erro presente em uma aplicação do QI total |
A confiabilidade de 0,929 mostra que a combinação das 9 tarefas produz uma estimativa de QI total com alta consistência. O valor foi estimado por um modelo que reflete a forma real de aplicação das tarefas e combina a confiabilidade de cada uma com o método atual de composição.
O SEM expressa o erro de medição na mesma escala do QI. Isso permite ler o QI total como uma estimativa com uma margem de alguns pontos, e não como um valor definitivo com precisão de uma unidade.
A confiabilidade dos 5 domínios variou de 0,726 a 0,852
A confiabilidade de Gc, Gf, Gv, Gwm e Gs também foi estimada a partir da estrutura atual de tarefas e do método de composição.
| Domínio | Tarefas que o compõem | Confiabilidade |
|---|---|---|
| Gc | Vocabulário e analogias verbais | 0,852 |
| Gf | Raciocínio matricial e raciocínio com balanças | 0,834 |
| Gv | Dobramento de papel e quebra-cabeças de montagem | 0,789 |
| Gwm | Memória de cálculo mental e memória em ordem inversa | 0,726 |
| Gs | Busca de símbolos | 0,734 |
Todos os 5 domínios ficaram acima de 0,70 e permitem observar com boa precisão os principais padrões entre habilidades. Ao reunir as informações das 9 tarefas, o QI total alcançou 0,929 e se tornou o indicador mais estável entre os resultados do BrainTypeIQ.
A relação entre tarefas e domínios está em como 9 tarefas medem 5 habilidades cognitivas. O caminho das pontuações por tarefa até o QI total e os 5 domínios é explicado no método de pontuação do BrainTypeIQ.
Os resultados foram semelhantes nas primeiras 420 e nas 421 aplicações seguintes
As 841 pessoas foram separadas por período de aplicação: as primeiras 420 e as 421 seguintes. A consistência do conjunto das 9 tarefas foi então calculada em cada metade.
| Dados | Alfa de Cronbach padronizado das 9 tarefas |
|---|---|
| Primeiras 420 pessoas | 0,844 |
| 421 pessoas seguintes | 0,846 |
| Total de 841 pessoas | 0,845 |
Os valores das duas metades foram praticamente iguais. A consistência das 9 tarefas permaneceu estável entre os dois grupos de participantes, sem depender de uma fase específica da coleta.
A normatização da versão japonesa usa as mesmas 841 pessoas que atenderam aos critérios da análise. Assim, a referência de comparação e os indicadores de confiabilidade foram analisados com base no mesmo conjunto de dados.
QI total e pontuações por domínio têm funções diferentes
| Resultado | Função principal |
|---|---|
| QI total | Reunir as 9 tarefas para observar o nível geral de desempenho cognitivo |
| 5 domínios | Mostrar os principais padrões entre Gc, Gf, Gv, Gwm e Gs |
O QI total deve ser lido como uma estimativa do nível geral que inclui uma margem de alguns pontos. Como cada domínio é formado por uma ou duas tarefas, suas pontuações servem para observar padrões amplos — quais domínios aparecem relativamente mais altos ou mais baixos — e não para ordenar diferenças de um ponto.
Como ler o relatório do BrainTypeIQ mostra como combinar QI total e 5 domínios. Os critérios gerais de confiabilidade, SEM e outras evidências estão em qualidade de medição de um teste de QI.
Esses indicadores se referem à versão japonesa. A versão em português brasileiro adota atualmente um modelo provisório de pontuação enquanto amplia seu próprio conjunto de dados.