在日语版841人的分析中,BrainTypeIQ 综合 IQ 的信度为 .929,测量标准误(SEM)约为4.0分。与5个领域相比,汇总9项分测验后得到的综合 IQ 结果更为稳定。
简体中文版目前采用基于日语版调整的暂定计分方式,正在收集数据。
综合 IQ 的信度为 .929,SEM 约为4.0分
我们从日语版已经积累的2,000多条完成记录中,核对作答情况、重复测试、题目和计分条件,选出在相同条件下首次完成现行9项分测验的841人进行分析。
| 指标 | 结果 | 解读分数时的含义 |
|---|---|---|
| 综合 IQ 的复合信度 | .929 | 汇总9项分测验后,综合 IQ 的分数精度 |
| 测量标准误(SEM) | 约4.0分 | 单次综合 IQ 中测量误差的大小 |
信度 .929表明,通过组合9项分测验,可以得到一致性较高的综合 IQ。这一数值通过反映实际出题方式的模型估算得出,模型同时纳入了各分测验的信度和当前的合成方法。
SEM 用与 IQ 相同的量尺表示测量误差的大小。综合 IQ 不应被视为精确到1分的确定值,而应作为带有一定误差范围的估计值来解读。
综合 IQ 用来看整体水平,5个领域用来看主要模式
| 结果 | 主要作用 |
|---|---|
| 综合 IQ | 汇总9项分测验,了解认知能力的整体水平 |
| 5个领域 | 了解 Gc、Gf、Gv、Gwm、Gs 的主要分数模式 |
综合 IQ 应作为包含一定误差范围的估计值,用来了解整体水平。5个领域由1至2项分测验构成,因此不适合用来比较精确到1分的细微差异,而是用来观察哪些领域相对较高、哪些相对较低的整体模式。
如何在实际结果页面中结合综合 IQ 和5个领域,可以阅读如何解读 BrainTypeIQ 报告;包含信度和 SEM 在内的 IQ 测试质量标准,则在IQ 测试的测量质量中有详细说明。
5个领域的信度为 .726至 .852
Gc、Gf、Gv、Gwm 和 Gs 各领域的信度,也根据当前的分测验构成和合成方法进行估计。
| 领域 | 构成该领域的分测验 | 信度 |
|---|---|---|
| Gc | 词汇、言语类推 | .852 |
| Gf | 矩阵推理、天秤推理 | .834 |
| Gv | 折纸、组合拼图 | .789 |
| Gwm | 心算记忆、倒序记忆 | .726 |
| Gs | 符号检索 | .734 |
5个领域的信度都高于 .70,其精度足以用于观察各项能力的总体分数模式。进一步汇总全部9项分测验信息的综合 IQ 信度达到 .929,是 BrainTypeIQ 各项结果中最稳定的指标。
分测验与领域的对应关系,可以阅读用9项分测验测量5个认知领域的设计;从分测验分数得到综合 IQ 和5个领域的步骤,可以阅读BrainTypeIQ 的计分方法。
9项分测验的一致性在前后两组中几乎相同
我们按照测试时间把841人分为前半组420人和后半组421人,检验9项分测验整体的一致性。
| 数据 | 9项分测验的标准化 Cronbach α |
|---|---|
| 前半组420人 | .844 |
| 后半组421人 | .846 |
| 全部841人 | .845 |
前后两组的数值几乎相同。即使把不同时间参加测试的人分开,9项分测验表现出的内部一致性仍然相近,说明这一结果并不局限于某一特定时期。
日语版的常模构建也使用了通过同一质量检查的841人。参照基准和信度指标都基于相同的分析对象进行检验。