Jangan anggap IQ daripada ujian yang tidak menerbitkan bukti pengukurannya sebagai angka yang tepat. Iklan, kedudukan carian, paparan keputusan yang kemas dan sijil IQ bukan bukti kualiti pengukuran. Bayaran dan syarat kontrak turut dibincangkan dalam cara memilih ujian IQ dalam talian yang boleh dipercayai.
Empat unsur yang menentukan kualiti ujian IQ
| Unsur | Soalan yang dijawab | Masalah apabila tiada asas yang kukuh |
|---|---|---|
| Penyeragaman | Adakah keadaan pelaksanaan dan penskoran konsisten? | Peranti, masa atau cara penskoran mencampuri skor |
| Norma | Data siapa yang menjadi perbandingan? | Makna IQ 100 atau 2% teratas tidak dapat ditentukan |
| Kebolehpercayaan | Sejauh mana skor mengandungi maklumat yang konsisten? | Jawapan betul atau salah secara kebetulan banyak mengubah angka |
| Kesahan | Adakah skor benar-benar boleh ditafsir sebagai kebolehan yang dinyatakan? | Skor penaakulan bentuk diperluas menjadi IQ keseluruhan tanpa asas |
Satu unsur sahaja tidak mencukupi. Contohnya, ujian penaakulan bentuk yang sangat konsisten tetap tidak mengukur IQ keseluruhan yang merangkumi bahasa, memori dan kelajuan pemprosesan jika bidang itu tidak diuji.
Penyeragaman dan norma perbandingan
Penyeragaman bermaksud menyelaraskan arahan, had masa, penyampaian soalan, penskoran serta cara tamat masa dan gangguan ditangani. Dalam talian, perbezaan paparan telefon dan komputer, kelewatan sambungan, ulangan ujian serta penggunaan carian atau nota turut mempengaruhi keadaan pengukuran. Jika kebolehan yang sama menghasilkan IQ yang jauh berbeza hanya kerana peranti atau bilangan percubaan, skor itu sukar dibandingkan secara bermakna.
Norma ialah kumpulan perbandingan bagi IQ. Mana-mana kumpulan data boleh ditukar kepada purata 100 dan sisihan piawai 15. Namun, menetapkan purata pelawat sesuatu laman kepada 100 tidak terus menunjukkan kedudukan seseorang dalam populasi dewasa Malaysia.
Mutu norma bergantung pada bilangan peserta, umur, bahasa, wilayah, cara pengambilan peserta, pengendalian ulangan, respons luar biasa dan peserta yang tidak selesai. Pelarasan umur, tahun pengumpulan serta padanan dengan soalan dan kaedah penskoran semasa juga diperlukan.
Label “100,000 peserta” tidak mencukupi jika tidak diketahui berapa orang mengulang ujian, komposisi umur atau bila data dikumpul. Terjemahan ke Bahasa Melayu sahaja juga tidak mengesahkan penggunaan norma versi bahasa lain tanpa penyesuaian. Sebagai contoh, prinsip Japan Association for Research on Testing meminta kumpulan rujukan, sampel, prosedur penyeragaman dan maklumat statistik direkodkan serta diterbitkan.
Kebolehpercayaan, ralat pengukuran dan selang keyakinan
Kebolehpercayaan dinyatakan dengan pekali antara 0 dan 1 untuk menunjukkan sejauh mana skor mengandungi maklumat yang konsisten. Kebolehpercayaan yang menilai hubungan antara item dan kebolehpercayaan uji-ulang pada hari berlainan menjawab soalan yang berbeza. Angka “.90” memerlukan penjelasan tentang jenis analisis, sampel dan skor yang dianalisis.
Daripada kebolehpercayaan, ralat piawai pengukuran atau SEM boleh dikira. Pada skala IQ dengan sisihan piawai 15, kebolehpercayaan .90 memberikan SEM sekitar 4.7 mata. Menggunakan kaedah selang keyakinan 95% dengan ±1.96 SEM, skor IQ 130 mempunyai julat kira-kira 121–139. Kebolehpercayaan .90 bukan ketepatan hingga satu mata.
Julat ini merujuk kepada ralat pada satu skor individu. Selang yang sempit tidak menyelesaikan bias sampel norma atau persoalan sama ada penaakulan bentuk wajar disebut IQ keseluruhan.
Kesahan dan keluasan kebolehan yang diukur
Kesahan menentukan sama ada skor boleh ditafsir mengikut kebolehan yang dinyatakan. Bukti yang diperlukan merangkumi kandungan tugas yang meliputi kebolehan, struktur skor yang disokong data, dan hubungan yang dijangka dengan ujian kecerdasan atau tugas berkaitan.
Soalan bentuk dan matriks boleh menjadi ujian penaakulan visual atau penaakulan cecair yang baik. Namun, kebolehpercayaan tinggi pada 30 soalan bentuk tidak bermakna kosa kata, pengetahuan, memori kerja dan kelajuan pemprosesan sudah diukur. IQ keseluruhan memerlukan beberapa jenis kebolehan serta bukti bahawa skornya sesuai digabungkan.
“Korelasi .70 dengan ujian IQ sedia ada” juga bukan bermakna “70% tepat”. Korelasi menunjukkan sejauh mana dua skor naik dan turun bersama. Jika 10 mata ditambah kepada skor setiap orang, korelasinya dengan skor asal ialah 1, tetapi semua angka tersasar 10 mata. Nama dan edisi ujian pembanding, sampel, beza purata serta perbezaan mengikut julat skor diperlukan untuk menilai sama ada kedua-duanya boleh dianggap IQ yang setara.
Skor IQ tinggi memerlukan soalan dan norma yang sesuai
Untuk membezakan IQ 130 daripada 140, dua had pengukuran perlu diatasi.
| Had | Keperluan | Akibat jika tidak mencukupi |
|---|---|---|
| Had kesukaran soalan | Soalan yang masih membezakan peserta berkebolehan tinggi | Hampir semua peserta teratas menjawab semuanya dengan betul |
| Had data norma | Data dan kaedah penukaran yang mencukupi pada hujung atas taburan | Perbezaan IQ yang kecil tidak dapat dianggarkan dengan stabil |
Sampel yang besar secara keseluruhan masih mempunyai sedikit peserta pada hujung taburan. Dengan andaian taburan normal berpurata 100 dan sisihan piawai 15, sampel 2,000 orang hanya mempunyai kira-kira lapan orang dengan IQ 140 ke atas. Ini terlalu sedikit untuk membezakan IQ 140, 142 dan 145 secara terperinci. Hubungan skor IQ dengan peratus populasi menunjukkan mengapa data semakin sukar dikumpul pada skor tinggi.
Dalam sampel norma biasa WISC-V seramai 2,200 orang, hanya 16 kanak-kanak mempunyai sekurang-kurangnya satu skor komposit 150 atau lebih. Norma lanjutan untuk skor tinggi kemudian dibangunkan dan turut diuji dengan sampel berasingan 108 kanak-kanak berkebolehan tinggi. Ujian terkenal sekalipun memerlukan reka bentuk dan data khusus untuk julat teratas.
Maklumat yang diperlukan untuk menilai dakwaan skor
| Perkara yang dinilai | Maklumat yang diperlukan |
|---|---|
| Skor dibandingkan dengan siapa? | Populasi sasaran, komposisi sampel, tahun pengumpulan dan kaedah penukaran |
| Kebolehan apa yang diukur? | Kandungan tugas, struktur skor, kaedah dan hasil pengujian kesahan |
| Berapa besar ralatnya? | Keadaan pelaksanaan, jenis kebolehpercayaan, SEM dan pengujian julat skor tinggi |
Penerbit tidak perlu mendedahkan semua data mentah, algoritma atau soalan sebenar. Maklumat tentang sasaran, sampel, pelaksanaan, penukaran, kebolehpercayaan, ralat, hasil utama kesahan dan padanan dengan versi semasa sudah membolehkan pengguna menilai dakwaan.
Jika maklumat ini tiada, paparan “IQ 137” tidak menjadikan makna dan ketepatannya boleh disahkan. Jangan percaya angka IQ yang terperinci sebagai ukuran tepat apabila bukti pengukurannya tidak diterbitkan.
Bukti pengukuran yang diterangkan oleh BrainTypeIQ
BrainTypeIQ menerangkan pemilihan sembilan subujian dan padanannya dengan lima bidang, serta cara IQ keseluruhan dan profil dibentuk.
Kaedah menukar dan menggabungkan skor turut diterangkan. Bagi versi Jepun, norma dibina daripada 841 peserta yang melengkapkan ujian buat kali pertama, dengan kebolehpercayaan IQ keseluruhan .929 dan SEM sekitar 4.0 mata.
Jika keputusan diperlukan untuk penilaian profesional atau laporan kepada pihak luar, perbezaan peranan WAIS dan ujian dalam talian membantu menentukan pilihan yang sesuai.