যে পরীক্ষা তার মান বিচার করার প্রয়োজনীয় প্রমাণ প্রকাশ করে না, তার IQ-কে নির্ভুল সংখ্যা হিসেবে বিশ্বাস করবেন না। বিজ্ঞাপন, সার্চের ফলাফলে ওপরের অবস্থান, সুন্দর ফলাফলের পৃষ্ঠা বা IQ সনদ পরিমাপের মানের প্রমাণ নয়। মূল্য ও চুক্তির শর্তসহ পরীক্ষা বেছে নেওয়ার বিষয়গুলো রয়েছে নির্ভরযোগ্য অনলাইন IQ পরীক্ষা বেছে নেওয়ার উপায় নিবন্ধে।
IQ পরীক্ষার পরিমাপের মান নির্ধারণের 4টি উপাদান
| উপাদান | কী যাচাই করতে হয় | না থাকলে কী হয় |
|---|---|---|
| প্রমিতকরণ | পরীক্ষা নেওয়া ও নম্বর দেওয়ার শর্ত সবার জন্য একই কি না | যন্ত্র, সময় বা নম্বর দেওয়ার পদ্ধতির পার্থক্য স্কোরে ঢুকে পড়ে |
| নর্ম | কাদের তথ্যের সঙ্গে তুলনা করা হচ্ছে | IQ 100 বা শীর্ষ 2%-এর অর্থ নির্ধারিত হয় না |
| নির্ভরযোগ্যতা | স্কোর কতটা সঙ্গতিপূর্ণ | দৈবভাবে সঠিক বা ভুল উত্তর দেওয়ায় স্কোর অনেক বদলে যায় |
| যথার্থতা | স্কোরটি যে ক্ষমতার নামে দেখানো হচ্ছে, সত্যিই সেই ক্ষমতা বোঝায় কি না | চিত্রভিত্তিক যুক্তির ফলাফলকে অতিরিক্ত বিস্তৃত করে সামগ্রিক IQ বলা হয় |
শুধু এই 4টির যেকোনো একটি দিয়ে IQ-এর পরিমাপের মান বিচার করা যায় না। যেমন, নির্ভরযোগ্যতা বেশি হলেও শুধু চিত্রভিত্তিক যুক্তি মাপলে সেই ফলকে ভাষা, স্মৃতি ও তথ্য প্রক্রিয়াকরণের গতি অন্তর্ভুক্ত করা সামগ্রিক IQ হিসেবে ব্যাখ্যা করা যথার্থ নয়।
প্রমিতকরণ ও নর্ম
প্রমিতকরণ মানে নির্দেশনা, সময়সীমা, প্রশ্ন উপস্থাপন, নম্বর দেওয়া এবং সময় শেষ হওয়া বা পরীক্ষা মাঝপথে থেমে যাওয়ার নিয়ম একই রাখা। অনলাইনে স্মার্টফোন ও কম্পিউটারের পর্দার পার্থক্য, সংযোগের বিলম্ব, পুনরায় পরীক্ষায় অংশ নেওয়া, তথ্য খোঁজা ও নোট ব্যবহারের নিয়মও স্কোর পাওয়ার শর্তের অংশ। একই ক্ষমতার মানুষের IQ যদি শুধু ব্যবহৃত যন্ত্র বা পরীক্ষায় অংশ নেওয়ার সংখ্যার কারণে অনেক আলাদা হয়, তবে সেই স্কেলে তুলনা করা যায় না।
নর্ম হলো IQ-এর তুলনার মানদণ্ড গোষ্ঠী। সঠিক উত্তরের সংখ্যাকে গড় 100 ও প্রমিত বিচ্যুতি 15-এর স্কেলে রূপান্তর করা যেকোনো গোষ্ঠীর তথ্য দিয়েই সম্ভব। শুধু একটি ওয়েবসাইটের দর্শকদের গড় 100 ধরলে তা জাপানের সাধারণ প্রাপ্তবয়স্ক জনগোষ্ঠীর মধ্যে অবস্থান প্রকাশ করে না।
নর্মের ক্ষেত্রে শুধু মানুষের সংখ্যা নয়, বয়স, ভাষা, অঞ্চল, অংশগ্রহণকারী সংগ্রহের পদ্ধতি, পুনরায় অংশ নেওয়া, অস্বাভাবিক উত্তর ও মাঝপথে ছেড়ে যাওয়ার তথ্য কীভাবে নেওয়া হয়েছে, বয়স সমন্বয়, তথ্য সংগ্রহের বছর এবং বর্তমান প্রশ্ন ও নম্বর দেওয়ার পদ্ধতির সঙ্গে তার মিলও দেখতে হয়।
“1 লাখ পরীক্ষার্থী” থাকলেও একই ব্যক্তির পুনরায় অংশ নেওয়া এর মধ্যে আছে কি না, কোন বয়সের কতজন আছেন বা তথ্য কখন সংগ্রহ করা হয়েছে—এসব জানা না থাকলে নর্মের মান বিচার করা যায় না। কোনো পরীক্ষাকে শুধু জাপানি ভাষায় অনুবাদ করে অন্য ভাষার সংস্করণের নর্ম সরাসরি প্রয়োগ করা যায় না। জাপান সোসাইটি ফর টেস্টিং-এর মৌলিক বিধানেও মানদণ্ড গোষ্ঠী, নমুনা, প্রমিতকরণের পদ্ধতি ও পরিসংখ্যানসংক্রান্ত তথ্য নথিবদ্ধ ও প্রকাশ করার কথা বলা হয়েছে।
নির্ভরযোগ্যতা, পরিমাপগত ত্রুটি ও আস্থার ব্যবধান
নির্ভরযোগ্যতা 0 থেকে 1-এর একটি সহগ দিয়ে বোঝায়, স্কোরে কতটা সঙ্গতিপূর্ণ তথ্য রয়েছে। প্রশ্নগুলো একসঙ্গে কতটা সঙ্গতিপূর্ণ, তার নির্ভরযোগ্যতা এবং অন্য দিনে পরীক্ষা দিলে স্কোর কতটা স্থিতিশীল থাকে, তার পুনঃপরীক্ষণ নির্ভরযোগ্যতা ভিন্ন প্রশ্নের উত্তর দেয়। শুধু “নির্ভরযোগ্যতা .90” বলা যথেষ্ট নয়; কোন ধরনের নির্ভরযোগ্যতা, কাদের তথ্য দিয়ে এবং কোন স্কোরের জন্য হিসাব করা হয়েছে, সেটিও জানা প্রয়োজন।
নির্ভরযোগ্যতা থেকে ব্যক্তির স্কোরের পরিমাপের প্রমিত ত্রুটি বা SEM হিসাব করা যায়। প্রমিত বিচ্যুতি 15-এর IQ স্কেলে নির্ভরযোগ্যতা .90 হলে SEM প্রায় 4.7 পয়েন্ট। ±1.96SEM দিয়ে 95% আস্থার ব্যবধান হিসাব করলে IQ 130-এর সীমা হয় প্রায় 121–139। নির্ভরযোগ্যতা .90 মানে প্রতি 1 পয়েন্ট পর্যন্ত নির্ভুলতা নয়।
এখানে একজনের একবারের স্কোরে থাকা পরিমাপগত ত্রুটি বোঝানো হচ্ছে। নর্মের নমুনায় পক্ষপাত থাকলে বা চিত্রভিত্তিক যুক্তির ফলকে সামগ্রিক IQ বলা যথার্থ কি না—এসব প্রশ্ন সরু আস্থার ব্যবধান দিয়ে মেটে না।
যথার্থতা ও যে ক্ষমতাগুলো মাপা হচ্ছে
যথার্থতা নির্ধারণ করে, স্কোরকে যে ক্ষমতার নামে দেখানো হচ্ছে, সেই ক্ষমতা হিসেবেই তা ব্যাখ্যা করা যায় কি না। এখানে দেখতে হয়, প্রশ্নগুলো ক্ষমতাটির পুরো পরিধি ধরছে কি না, অনুমিত স্কোরের কাঠামো তথ্য দিয়ে যাচাই করা হয়েছে কি না এবং প্রতিষ্ঠিত বুদ্ধিমত্তা পরীক্ষা বা সম্পর্কিত কাজের সঙ্গে প্রত্যাশিত সম্পর্ক পাওয়া যাচ্ছে কি না।
চিত্রভিত্তিক প্রশ্ন বা ম্যাট্রিক্স রিজনিং চিত্রভিত্তিক যুক্তি কিংবা নতুন সমস্যায় যুক্তি প্রয়োগের ভালো পরীক্ষা হতে পারে। তবে চিত্রের 30টি প্রশ্নে উচ্চ নির্ভরযোগ্যতা পাওয়া গেলেও শব্দভান্ডার, জ্ঞান, কার্যকরী স্মৃতি বা তথ্য প্রক্রিয়াকরণের গতি মাপা হয় না। সামগ্রিক IQ দেখাতে হলে একাধিক ক্ষমতা মাপার প্রশ্ন এবং সেগুলোকে একটি সামগ্রিক স্কোরে একত্র করার পক্ষে প্রমাণ দরকার।
“প্রতিষ্ঠিত IQ পরীক্ষার সঙ্গে সহসম্পর্ক .70” মানেও 70% নির্ভুলতা নয়। সহসম্পর্ক বোঝায় দুটি স্কোর একসঙ্গে কতটা ওঠানামা করে। সবার মূল স্কোরে সমানভাবে 10 পয়েন্ট যোগ করলে নতুন স্কোরের সঙ্গে মূল স্কোরের সহসম্পর্ক হবে 1, কিন্তু প্রত্যেকের সংখ্যাই 10 পয়েন্ট সরে যাবে। তুলনার পরীক্ষার নাম ও সংস্করণ, নমুনা, গড়ের পার্থক্য এবং বিভিন্ন স্কোরের স্তরে পার্থক্য না দেখলে দুটি স্কোরকে একই IQ হিসেবে নেওয়া যায় কি না, তা বিচার করা যায় না।
উচ্চ IQ মাপার জন্য প্রশ্ন ও নর্ম
IQ 130 ও 140-এর পার্থক্য ধরতে দুটি ঊর্ধ্বসীমা অতিক্রম করা দরকার।
| ঊর্ধ্বসীমা | কী প্রয়োজন | ঘাটতি থাকলে কী হয় |
|---|---|---|
| প্রশ্নের ঊর্ধ্বসীমা | উচ্চ ক্ষমতার ব্যক্তিদের মধ্যেও পার্থক্য ধরতে পারে এমন প্রশ্ন | ওপরের দিকের পরীক্ষার্থীরা প্রায় সব উত্তর সঠিক দেন, ফলে ক্ষমতার পার্থক্য ধরা যায় না |
| নর্মের ঊর্ধ্বসীমা | উচ্চ স্কোরের জন্য যথেষ্ট তথ্য ও উপযুক্ত রূপান্তরপদ্ধতি | একই সঠিক উত্তরের সংখ্যা থেকে সূক্ষ্ম IQ পার্থক্য স্থিতিশীলভাবে অনুমান করা যায় না |
মোট নমুনা বড় হলেও বণ্টনের প্রান্তে থাকা মানুষের সংখ্যা কম। গড় 100 ও প্রমিত বিচ্যুতি 15-এর স্বাভাবিক বণ্টন ধরলে 2,000 জনের নমুনায় IQ 140 বা তার বেশি এমন মানুষ থাকবেন প্রায় 8 জন। শুধু এই তথ্য দিয়ে IQ 140, 142 ও 145-এর সূক্ষ্ম পার্থক্য করা কঠিন। IQ স্কোর ও জনসংখ্যার অনুপাত দেখলে বোঝা যায়, স্কোর যত বাড়ে প্রয়োজনীয় তথ্য সংগ্রহ করা তত কঠিন হয় কেন।
যুক্তরাষ্ট্রের WISC-V-এর সাধারণ নর্মের 2,200 জনের নমুনায় যেকোনো একটি যৌগিক স্কোর 150 বা তার বেশি ছিল এমন শিশুর সংখ্যা ছিল 16। তাই উচ্চ স্কোরের জন্য সম্প্রসারিত নর্ম তৈরি করা হয় এবং উচ্চ ক্ষমতাসম্পন্ন 108 জন শিশুর আলাদা নমুনাতেও তা যাচাই করা হয়। সুপরিচিত পরীক্ষার ক্ষেত্রেও উচ্চ স্কোর মাপতে বিশেষ প্রশ্নের নকশা ও তথ্য দরকার।
পরিমাপের মান বিচার করতে যে তথ্য প্রকাশ করা দরকার
প্রকাশিত তথ্যে প্রচারমূলক দাবির বদলে নিচের বিষয়গুলোর উত্তর খুঁজতে হয়।
| বিচারের বিষয় | প্রয়োজনীয় প্রকাশিত তথ্য |
|---|---|
| কাদের মানদণ্ড ধরে এই সংখ্যা | লক্ষ্য জনগোষ্ঠী, নমুনার গঠন, তথ্য সংগ্রহের বছর, রূপান্তরপদ্ধতি |
| কোন ক্ষমতার পরিমাপ এই সংখ্যা | প্রশ্নের গঠন, স্কোরের কাঠামো, যথার্থতা যাচাইয়ের পদ্ধতি ও ফল |
| সংখ্যাটিতে কতটা ত্রুটি আছে | পরীক্ষা নেওয়ার শর্ত, নির্ভরযোগ্যতার ধরন, SEM, উচ্চ স্কোর যাচাইয়ের পদ্ধতি |
মূল তথ্য, নম্বর দেওয়ার অ্যালগরিদম বা আসল প্রশ্নের সবকিছু প্রকাশ করা জরুরি নয়। লক্ষ্য গোষ্ঠী, নমুনা, পরীক্ষা নেওয়ার শর্ত, রূপান্তরপদ্ধতি, নির্ভরযোগ্যতা ও ত্রুটি, যথার্থতার প্রধান ফল এবং কারিগরি তথ্য বর্তমান সংস্করণের সঙ্গে মেলে কি না—এসব জানা থাকলে ব্যবহারকারী দাবিগুলো বিচার করতে পারেন।
অন্যদিকে, এই বিচার করার মতো তথ্য না থাকলে IQ 137-এর মতো সূক্ষ্ম সংখ্যা দেখালেও তার অর্থ বা নির্ভুলতা যাচাই করা যায় না। যে পরীক্ষা প্রমাণ প্রকাশ করে না, তার IQ-কে নির্ভুল সংখ্যা হিসেবে বিশ্বাস করবেন না। ব্যবহারিক সিদ্ধান্ত এটিই।
BrainTypeIQ-এর প্রকাশিত পরিমাপসংক্রান্ত প্রমাণ
BrainTypeIQ 9টি উপপরীক্ষা বেছে নেওয়ার কারণ ও 5টি ক্ষেত্রের সঙ্গে তাদের সম্পর্ক প্রকাশ করে এবং 9টি উপপরীক্ষা থেকে সামগ্রিক IQ ও 5টি ক্ষেত্রের স্কোর তৈরি করে।
প্রমিত স্কোরে রূপান্তর ও স্কোর একত্র করার পদ্ধতি, জাপানি সংস্করণ প্রথমবার সম্পন্ন করা 841 জনের নর্ম এবং জাপানি সংস্করণের সামগ্রিক IQ-এর নির্ভরযোগ্যতা .929 ও SEM প্রায় 4.0 পয়েন্ট-ও প্রকাশ করা হয়েছে। আনুষ্ঠানিক মূল্যায়ন বা কোনো প্রতিষ্ঠানে ফলাফল জমা দেওয়া উদ্দেশ্য হলে অনলাইন পরীক্ষার মান তুলনা করার বদলে WAIS-IV ও অনলাইন IQ পরীক্ষার ভূমিকার পার্থক্য অনুযায়ী পরীক্ষা বেছে নিন।