常模构建是确定各项分测验的原始分数在常模群体中的位置,并据此转换为可在同一 IQ 量尺上比较的分数。BrainTypeIQ 日语版使用符合统一分析条件的841名首次完成者作为参照基准。
简体中文版目前采用基于日语版调整的暂定计分方式,正在收集数据。
从2,000多条完成记录中选出841人建立参照基准
日语版已经积累了2,000多条完成记录。不过,其中也包括重复测试,以及使用与当前版本不同的题目或计分条件完成的记录。
因此,我们核对了作答情况、测试记录、所用题目和计分条件,把分析对象统一为在相同条件下首次完成现行9项分测验的841人。9项分测验的参照基准就是根据这841人的原始分数分布建立的。
同一批841人也用于BrainTypeIQ 信度指标的分析。
BrainTypeIQ 的 IQ 和百分位,表示相对于这批日语版首次完成者的相对位置。IQ 100、120、130与百分位的对应关系可以作为解读这一共同量尺上位置的参考。
常模构建把原始分数转换为可比较的 IQ
即使同样答对20题,如果分测验的题目数量、难度或比较群体不同,也不一定代表相同的能力水平。因此,要先确定9项分测验各自的原始分数在841人分布中的位置,再转换为能在分测验之间比较的共同量尺。
从分测验分数计算5个领域、GAI、CPI 和综合 IQ 的步骤,可以阅读BrainTypeIQ 的计分方法。IQ 测试的测量质量则分别说明了常模构建、信度与效度的作用。
使用 18 至 54 岁的 739 人建立年龄趋势模型
建立原始分数分布时使用全部841人的数据;年龄模型则主要使用其中18至54岁的739人建立。
| 领域 | 年龄信息的处理方式 |
|---|---|
| Gc(言语理解) | 不进行年龄校正 |
| Gf、Gv、Gwm、Gs | 把数据中观察到的年龄趋势反映到分测验分数中 |
之所以采用不同处理方式,是因为不同能力与年龄的关系并不相同。各项能力随年龄变化的情况,在智力与年龄中有更详细的说明。
拆分验证中,各年龄段综合 IQ 平均值最多相差3.77分
我们在保留年龄构成的情况下,把用于建立参照基准的841人拆分为70%的训练数据和30%的验证数据。用70%的数据建立换算规则,再应用到未参与建立规则的30%数据上。这个过程重复100次,以检验结果是否依赖某一次特定的数据拆分。最终,4个年龄段的综合 IQ 平均值最大差异为3.77分。
在未用于建立换算规则的数据中,各年龄段综合 IQ 平均值的差异也保持在4分以内,说明将年龄趋势纳入参照基准后,结果仍保持稳定。