يمثل صدق البناء (Construct Validity) الركيزة الجوهرية والعمود الفقري الذي يستند إليه القياس النفسي والتربوي المعاصر، إذ يحدد مدى قدرة أداة القياس على رصد وتجسيد السمة النفسية النظرية المجردة التي صُممت من أجلها دون غيرها. ولا تقتصر أهمية هذا المفهوم على مجرد كونه معياراً إحصائياً للضبط المنهجي، بل إنه يمثل الحجة الاستدلالية المتكاملة التي تبرر المعنى العلمي للدرجات المستخلصة من الاختبارات والمقاييس، وتحدد مدى مشروعية تعميمها واستخدامها في تفسير السلوك الإنساني واتخاذ القرارات السريرية والمهنية والتربوية المصيرية.
المفهوم والتعريف الأكاديمي لصدق البناء
يُعرَّف صدق البناء في أدبيات القياس المنهجي بأنه الدرجة التي تتطابق فيها الأدلة التجريبية والتنظيرية مع التفسيرات المقترحة لدرجات الاختبار، والتي تعكس بدورها البناء النفسي أو السمة المفترضة. والبناء النفسي (Psychological Construct) هو مفهوم نظري مجرد، غير قابل للملاحظة الحسية المباشرة، مثل الذكاء، أو القلق، أو تقدير الذات، أو دافعية الإنجاز، يُفترض وجوده لتفسير أنماط سلوكية منتظمة وقابلة للملاحظة. ومن هذا المنطلق، لا يتعامل صدق البناء مع الأداة الفيزيائية للاختبار بوصفها كياناً معزولاً، بل يتعامل مع صحة الاستدلالات (Inferences) والتأويلات المستندة إلى الدرجات الناتجة عنها.
تاريخياً، ارتبط المفهوم بالافتراض بأن أي أداة قياس تسعى إلى عزل البناء المستهدف عن البناءات الأخرى المتداخلة، وهو ما يعني التأكد من أن التباين الملاحظ في استجابات الأفراد يعود بالفعل إلى التباين الحقيقي في السمة النفسية المقاسة، وليس نتاجاً لأخطاء القياس أو لمتغيرات دخيلة. وقد تجاوزت النظريات الحديثة فكرة النظر إلى الصدق كخاصية ثنائية (موجود أو غير موجود) يمتلكها الاختبار، لتعتبره عملية مستمرة ومتواصلة لجمع الأدلة المتراكمة والحجج المنطقية والتجريبية لاختبار الفرضيات النظرية المتعلقة بطبيعة البناء المقاس.
وفقاً لهذا المنظور، فإن صدق البناء يتطلب بناء شبكة من العلاقات المتبادلة بين السمة محل الدراسة وغيرها من المفاهيم القائمة في التراث العلمي؛ إذ لا يمكن إثبات صدق مقياس يقيس “الاكتئاب”، على سبيل المثال، إلا إذا أظهر هذا المقياس ارتباطاً دالاً بالمؤشرات السلوكية والفسيولوجية للاكتئاب، وتمايزاً واضحاً عن مفاهيم قريبة كالقلق والوهن النفسي، وتطابقاً مع النظريات العيادية التي تفسر آليات نشوء المزاج المكتئب واستمراره.
التطور التاريخي لنظرية صدق البناء في القياس النفسي
قبل منتصف القرن العشرين، كان القياس النفسي أسيراً لمفاهيم ضيقة وميكانيكية للصدق، تمثلت أساساً في الصدق الظاهري (Face Validity)، وصدق المحتوى (Content Validity)، والصدق المرتبط بمحك (Criterion-Related Validity). وكان يُكتفى بأن يتنبأ الاختبار بمحك خارجي مباشر (مثل التنبؤ بالنجاح الوظيفي أو الأكاديمي) دون الحاجة لفهم الطبيعة النفسية الكامنة وراء هذا التنبؤ. غير أن قصور هذه الرؤية البراغماتية ظهر جلياً حين واجه علماء النفس الحاجة إلى قياس سمات شخصية وإكلينيكية معقدة لا تتوفر لها محكات خارجية موضوعية جاهزة أو معايير مطلقة.
حدث التحول الإبستيمولوجي الجذري في عام 1955، عندما نشر العالمان بول ميل (Paul Meehl) ولي كرونباخ (Lee Cronbach) ورقتهما المرجعية الخالدة بعنوان “صدق البناء في الاختبارات النفسية” (Construct Validity in Psychological Tests). طرح الباحثان مفهوماً ثورياً أطلق عليه اسم الشبكة القانونية أو الشبكة التفسيرية (Nomological Network)، وهي الإطار النظري الذي يربط بين البناءات النظرية والملاحظات التجريبية القابلة للقياس، وبين البناءات النظرية المختلفة مع بعضها البعض. وأوضحا أن إثبات صدق البناء يوازي تماماً عملية اختبار النظريات العلمية في العلوم الطبيعية والفيزيائية.
توالت بعد ذلك الجهود التطويرية، حتى قدم صامويل ميسيك (Samuel Messick) في أواخر الثمانينيات نموذجاً شاملاً وموحداً أعاد فيه تعريف الصدق؛ حيث جادل ميسيك بأن كل أشكال الصدق التقليدية (المحتوى، والمحك، والتقاربي) ليست أنواعاً منفصلة أو بديلة، بل هي في جوهرها مصادر مختلفة للأدلة تصب جميعها في رافد واحد هو صدق البناء. كما أضاف ميسيك بعداً نقدياً مهماً يتمثل في التبعات الاجتماعية والأخلاقية لاستخدام نتائج القياس، مما جعل صدق البناء مفهوماً ديناميكياً وأخلاقياً يمتد ليشمل الاستخدام التفسيري والقرارات المنبثقة عن نتائج القياس.
المكونات الأساسية لصدق البناء: التقارب والتمايز
يستند التحقق من صدق البناء إلى ركيزتين تجريبيتين متكاملتين صاغهما كامبل وفيسك (Campbell & Fiske) في دراستهما الرائدة عام 1959، وهما: الصدق التقاربي (Convergent Validity) والصدق التمايزي أو التمييزي (Discriminant Validity). ولا يمكن لصدق البناء أن يكتمل منهجياً دون توفير أدلة قاطعة تدعم كلا الركنين بالتزامن.
يشير الصدق التقاربي إلى مدى تماسك الاختبار وارتباطه القوي مع مقاييس أخرى مستقلة تقيس نفس البناء النظري أو بناءات وثيقة الصلة به تم التحقق من كفاءتها مسبقاً. فعلى سبيل المثال، إذا تم تطوير مقياس جديد لتقييم “الاحتراق النفسي”، فإن الصدق التقاربي يقتضي أن تظهر درجات هذا المقياس ارتباطات موجبة ومرتفعة دالة إحصائياً مع المقاييس العالمية المعيارية المعتمدة لنفس الظاهرة، مثل مقياس ماسلاش للاحتراق النفسي (MBI)، وكذلك مع مؤشرات التوتر المهني والإجهاد العاطفي المستمر.
في المقابل، يمثل الصدق التمايزي (أو التمييزي) الوجه الآخر للعملة، ويُقصد به قدرة المقياس على عدم الارتباط، أو الارتباط الضعيف للغاية، بالسمات والمفاهيم النظرية التي يفترض أنها مستقلة عنه وليست جزءاً من بنيته الجوهرية. فالاستمرار في نفس المثال المتعلق بالاحتراق النفسي يفرض على الباحث تقديم دليل على أن مقياسه لا يقيس مجرد “الاكتئاب العام” أو “الرضا الوظيفي المنخفض” كظواهر بديلة، بل يقيس تكويناً مستقلاً يتميز عن تلك المتغيرات حتى وإن تشابهت معها بعض المظاهر السطحية. إن غياب الارتباط المرتفع مع البناءات غير المستهدفة هو البرهان الحاسم على نقاء الأداة وتخصصها الوظيفي.
مصفوفة السمات المتعددة والطرائق المتعددة (MTMM)
لتقنين فحص الصدقين التقاربي والتمايزي بطريقة تجريبية صارمة، ابتكر دونالد كامبل ودونالد فيسك مصفوفة السمات المتعددة والطرائق المتعددة (Multitrait-Multimethod Matrix). تهدف هذه الطريقة المنهجية المعقدة إلى فصل تأثير “السمة” المراد قياسها عن تأثير “طريقة القياس” المستخدمة (مثل تقرير الذات، أو ملاحظة السلوك، أو تقييم الأقران)، حيث يُخشى دائماً أن يكون التوافق بين المقاييس عائداً إلى الاشتراك في أسلوب القياس ذاته وليس للسمة نفسها.
تعتمد المصفوفة على مقارنة معاملات الارتباط بين سمتين أو أكثر يتم قياسهما باستخدام طريقتين مختلفتين أو أكثر. وتتحقق فرضية صدق البناء عند توفر شروط دقيقة، أبرزها:
- أن تكون معاملات الارتباط بين الطرائق المختلفة لقياس نفس السمة (Monotrait-Heteromethod) دالة إحصائياً ومرتفعة، وهو ما يؤكد الصدق التقاربي بمعزل عن أثر الأداة.
- أن تكون هذه المعاملات أعلى بوضوح من معاملات الارتباط الناتجة عن قياس سمات مختلفة باستخدام نفس الطريقة (Heterotrait-Monomethod)، وهو ما يثبت أن السمة أقوى تأثيراً في الناتج من وسيلة القياس.
- أن تتفوق قيم الصدق التقاربي على معاملات الارتباط بين سمات مختلفة قيست بطرق مختلفة (Heterotrait-Heteromethod).
وقد شكلت هذه المصفوفة قفزة نوعية في تاريخ العلوم السلوكية، إذ كشفت مقدار التضخم الزائف في معاملات الارتباط الذي كان ينتج فقط عن التحيز الشائع المرتبط بالاعتماد الحصري على أدوات الاستبيانات ذاتية التقرير (Common Method Bias).
أبعاد صدق البناء في النموذج الموحد لميسيك
يعد الإطار المفاهيمي الذي صاغه صامويل ميسيك (Messick, 1989, 1995) التحليل الأكثر عمقاً وشمولاً لطبيعة صدق البناء، حيث قسم ميسيك الأدلة التي تؤيد صدق البناء إلى ستة أوجه أو أبعاد متكاملة، لا يعمل أي منها بمعزل عن الآخر:
1. البعد المحتوي (Content Aspect)
يتضمن الأدلة التي تؤكد أن بنود الأداة تمثل النطاق المعرفي أو السلوكي للبناء تمثيلاً شاملاً ومتوازناً، مع التأكد من وضوح الصياغة، وملاءمة المفردات للسياق الثقافي، واستبعاد البنود التي تخرج عن النطاق المفاهيمي المحدد مسبقاً في التعريف الإجرائي.
2. البعد الجوهري أو المعرفي (Substantive Aspect)
يركز هذا البعد على التحقق من أن العمليات العقلية والأنماط المعرفية أو الانفعالية التي ينخرط فيها المفحوصون أثناء الإجابة على الاختبار تطابق بالفعل الآليات النظرية التي يفترضها البناء. ويتم جمع هذه الأدلة عبر المقابلات الاسترجاعية، وبروتوكولات التفكير بصوت عالٍ، وتحليل حركات العين والنشاط العصبي المصاحب لحل المشكلات المعقدة داخل بنود المقياس.
3. البعد البنائي أو الهيكلي (Structural Aspect)
يتعلق بمدى توافق العلاقات الداخلية بين بنود الاختبار وفقراته الفرعية مع البنية النظرية للبناء النفسي. فإذا كانت النظرية تفترض أن الذكاء يتكون من عوامل متعددة متدرجة هرمياً (مثل نموذج كاتل-هورن-كارول)، فيجب أن تنعكس هذه البنية الهيكلية بوضوح في النماذج الإحصائية وتوزيع أوزان البنود والمعاملات الارتباطية الداخلية.
4. بعد القابلية للتعميم (Generalizability Aspect)
يفحص هذا البعد ثبات واستقرار معاني الدرجات وتفسيراتها عبر السياقات والبيئات والمجموعات السكانية المختلفة، وكذلك عبر الزمن والمهام المختلفة. ويهدف هذا الجانب إلى ضمان ألا تكون خصائص البناء الناتجة محصورة بعينة تجريبية محددة أو بيئة ثقافية ضيقة دون أن تمتلك صلاحية التعميم.
5. البعد الخارجي (External Aspect)
يشمل الأدلة المستمدة من علاقة الاختبار بمتغيرات وبناءات خارجية، ويندرج تحته دليلا الصدق التقاربي والتمايزي المذكوران، إضافة إلى القدرة التنبؤية للأداة بسلوكيات مستقبلية أو محكات سريرية حقيقية تدعم شبكتها التفسيرية والنظرية العامة.
6. البعد العواقبي أو التبعي (Consequential Aspect)
وهو الإسهام الأكثر إثارة للجدل في نموذج ميسيك؛ حيث ينظر هذا البعد في التداعيات الاجتماعية، والتأثيرات التعليمية والأخلاقية المحتملة المترتبة على تفسير واستخدام درجات الاختبار. ويستفسر هذا البعد: هل يؤدي تطبيق الاختبار وتفسير درجاته إلى عواقب سلبية غير مقصودة، أو تكريس لمظاهر تحيز نظامي ضد فئات عرقية أو طبقية معينة؟ يرى ميسيك أن التبعات الضارة الناتجة عن عيوب في بناء الأداة تُعد دليلاً مباشراً على ضعف صدق بنائها.
الأساليب المنهجية والإحصائية للتحقق من صدق البناء
شهدت تقنيات التحقق من صدق البناء تطورات متسارعة بفضل التقدم الهائل في الإحصاء الرياضي وبرمجيات الحوسبة المتقدمة، حيث تحول الباحثون من الاعتماد على معاملات الارتباط البسيطة إلى استخدام نماذج رياضية بالغة الدقة تتيح اختبار الفرضيات النظرية مباشرة على البيانات الميدانية.
التحليل العاملي الاستكشافي والتوكيدي
يعد التحليل العاملي (Factor Analysis) الأداة الإحصائية الأكثر شيوعاً في تقييم البنية العاملية للأدوات النفسية. ينقسم هذا التحليل إلى شقين أساسيين:
- التحليل العاملي الاستكشافي (EFA): يُستخدم في المراحل الأولى لتطوير المقاييس عندما تكون الروابط بين البنود والأبعاد الكامنة غير مؤكدة نظرياً؛ حيث يساعد على تلخيص التباين المشترك بين البنود في عدد أقل من العوامل الخفية وفحص تشبعات البنود (Factor Loadings) على كل عامل.
- التحليل العاملي التوكيدي (CFA): يمثل الأسلوب المنهجي الأرقى لاختبار صدق البناء؛ إذ ينطلق من نموذج نظري مفاهيمي محدد بدقة مسبقاً، ويقوم الباحث عبره باختبار مدى مطابقة البيانات الفعلية لهذا النموذج المفترض رياضياً. ويتم الاستدلال على جودة المطابقة من خلال مؤشرات متعددة، مثل مؤشر المقارنة التوافقي (CFI)، ومؤشر تكر-لويس (TLI)، وجذر متوسط مربعات خطأ الاقتراب (RMSEA).
تسمح نمذجة المعادلات البنائية (SEM) بالدمج بين نماذج القياس المأخوذة من التحليل العاملي التوكيدي والنماذج البنائية التي تحدد مسارات العلاقات السببية والتنبؤية بين البناءات الكامنة المختلفة، مع ضبط أخطاء القياس العشوائية والمنتظمة بصورة مستقلة، مما يعطي صورة واضحة لنقاء العلاقات بين التكوينات الفرضية.
تحليل التباين المستخلص (AVE) ومعيار فورنيل-لاركر
في إطار النمذجة المتقدمة، يُستخدم مقياس متوسط التباين المستخلص (Average Variance Extracted – AVE) لحساب نسبة التباين التي يستمدها البناء الكامن من بنوده مقارنة بنسبة التباين الناتجة عن خطأ القياس. ولتأكيد الصدق التقاربي، يُشترط عادة أن تتجاوز قيمة AVE عتبة 0.50، مما يعني أن المفهوم يفسر أكثر من نصف تباين مؤشراته.
أما لتقييم الصدق التمايزي إحصائياً، فيُطبق معيار فورنيل-لاركر (Fornell-Larcker Criterion)، والذي ينص على ضرورة أن يكون الجذر التربيعي لقيمة AVE لكل بناء نفسي أعلى من أي معامل ارتباط يربط ذلك البناء بأي بناء آخر في النموذج الهيكلي، وهو ما يضمن استقلالية البناء وتميزه المفهومي عن غيره.
طريقة الفروق بين الجماعات (Known-Groups Technique)
تعتمد هذه المقاربة شبه التجريبية على تطبيق أداة القياس على عينتين أو أكثر يُعرف مسبقاً، بناءً على النظريات الراسخة أو التشخيصات الإكلينيكية المستقلة، أنهما تختلفان اختلافاً جوهرياً وحاداً في السمة المستهدفة. على سبيل المثال، عند بناء مقياس جديد يقيس “الرهاب الاجتماعي”، فإن التحقق من صدق البناء يقتضي أن يحصل الأفراد الذين تم تشخيصهم رسمياً باضطراب القلق الاجتماعي في العيادات النفسية على درجات تفوق درجات عينة مطابقة من الأفراد الأسوياء بدرجة ذات دلالة إحصائية عالية وحجم أثر مرتفع؛ وإذا أخفق المقياس في التمييز بين هاتين المجموعتين، فإن ذلك يمثل دليلاً جوهرياً على سقوط صدق بنائه الإجرائي.
المهددات المعاصرة لصدق البناء
تواجه عملية جمع الأدلة المؤيدة لصدق البناء تحديات ومهددات منهجية جسيمة يمكن أن تقوض تفسير درجات الاختبار وتؤدي إلى استنتاجات مضللة. وقد حدد علماء القياس والتقويم مهددين رئيسيين هما بمثابة الخطيئة المنهجية الكبرى في بناء المقاييس:
1. نقص تمثيل البناء (Construct Underrepresentation)
يحدث نقص التمثيل عندما تفشل أداة القياس في استيعاب كافة الأبعاد الجوهرية والخصائص المميزة للسمة المستهدفة، فتكون الأداة ضيقة ومحدودة للغاية مقارنة باتساع المفهوم النظري. ومثال ذلك قياس “الكفاءة اللغوية” باختبار يقيم الحصيلة المعجمية والمفردات وقواعد النحو فقط، مهملاً تماماً قدرات التحدث التواصلي، وفهم الاستماع، والطلاقة التعبيرية؛ فهنا يُعد الاختبار منقوص التمثيل، ولا تمثل نتائجه الكفاءة اللغوية الحقيقية بحال من الأحوال.
2. تباين العناصر غير المرتبطة بالبناء (Construct-Irrelevant Variance)
يمثل هذا المهدد النقيض التام لنقص التمثيل؛ إذ يشير إلى تلوث درجات الاختبار بمتغيرات وأبعاد دخيلة ومستقلة تماماً عن البناء المنشود، مما يؤدي إلى زيادة تشتت الدرجات أو تذبذبها لأسباب خارجية. وينقسم هذا الخلل غالباً إلى شكلين:
- صعوبة غير مرتبطة بالبناء: حين يحتوي الاختبار على عوائق تعطل فئات معينة، مثل استخدام صياغات لغوية شديدة التعقيد في بنود اختبار يقيس التفكير الرياضي؛ مما يجعل أداء الطلاب ذوي الخلفيات اللغوية المتواضعة ضعيفاً بسبب عائق اللغة لا بسبب نقص مهاراتهم الرياضية.
- سهولة غير مرتبطة بالبناء: كأن تحتوي بنود الاختبار على تلميحات خفية تسهل التخمين الصحيح، أو أن تتأثر استجابات المفحوصين بأساليب الاستجابة الشائعة (Response Sets) مثل الرغبة الاجتماعية (Social Desirability)، أو الميل المستمر للموافقة (Acquiescence Bias)، مما يضخم الدرجات دون ارتباط حقيقي بالسمة المقاسة.
3. عدم التكافؤ عبر المجموعات وتحيز البنود (DIF)
يعد الأداء الوظيفي التفاضلي للبنود (Differential Item Functioning – DIF) مهدداً بارزاً ينتهك صدق البناء، ويحدث عندما يختلف احتمال الإجابة الصحيحة أو الموافقة على بند ما بين مجموعتين سكانيتين مختلفتين (وفقاً للجنس، أو العرق، أو الثقافة) رغم تمتع أفرادهما بنفس المستوى الحقيقي الكامن من السمة المقاسة. يشير وجود DIF إلى أن البند يتأثر بعوامل ثقافية أو اجتماعية غير مقصودة، مما يستدعي تعديل البند أو حذفه لضمان عدالة وموضوعية القياس النفسي.
التطبيقات السريرية والتربوية والبحثية
لا يقتصر صدق البناء على المناقشات التنظيرية في قاعات الجامعات، بل يرتبط ارتباطاً وثيقاً بسلامة الممارسات الإنسانية والمهنية اليومية؛ إذ يُترجم هذا المفهوم عملياً في قطاعات حساسة تتخذ فيها قرارات حاسمة تؤثر في مسارات الأفراد وحيواتهم:
في المجال الإكلينيكي والعلاجي، يعتمد التشخيص الدقيق للاضطرابات النفسية المدرجة في أدلة التصنيف العالمية، مثل الدليل التشخيصي والإحصائي للاضطرابات النفسية (DSM-5)، على أدوات تتمتع بأعلى مستويات صدق البناء. فإذا افتقر مقياس تشخيص اضطراب فرط الحركة وتشتت الانتباه (ADHD) إلى صدق البناء، فإنه قد يخلط بين أعراض الاضطراب وأعراض القلق الطفولي أو صدمات الطفولة المبكرة، مما يقود إلى وصف بروتوكولات دوائية كيميائية خاطئة قد تضر بنمو الطفل العصبي والنفسي.
وفي السياق التربوي والتعليمي، تتوقف موثوقية اختبارات القدرات المعرفية والقبول الجامعي ومقاييس التحصيل على مدى قدرتها على قياس التفكير النقدي والاستعداد الأكاديمي الحقيقي للطلاب بدلاً من قياس مهارات الحفظ الآلي أو القدرة المالية للأسر على توفير برامج التدريب الخاصة. إن توفير أدلة صدق البناء الصارمة هو الضمانة الوحيدة لحماية مبدأ تكافؤ الفرص في النظم التعليمية الحديثة.
أما في بيئات الأعمال والمؤسسات، فتعتمد استراتيجيات استقطاب الكفاءات واختبارات المواءمة المهنية على مقاييس السمات الشخصية مثل “عوامل الشخصية الخمسة الكبرى” (Big Five). ويتطلب ضمان صدق البناء في هذا السياق التأكد من أن مقاييس مثل “يقظة الضمير” و”الاستقرار العاطفي” تقيس بالفعل أنماط السلوك التنظيمي والقدرة على إدارة ضغوط العمل ومقاومة الإغراءات السلوكية المنحرفة في بيئة الوظيفة، دون التأثر بالتزييف والادعاء الموجه من قبل المتقدمين للوظائف.
الخلاصة والآفاق المستقبلية
يخلص البحث المعاصر في القياس النفسي إلى أن صدق البناء ليس مجرد رقم إحصائي يُحسب لمرة واحدة ويُودع في ملحق دليل الاختبار، بل هو حجة استدلالية ديناميكية مستمرة تتبلور عبر سيرورة البحث العلمي وتتطلب الجمع المتواصل للأدلة التجريبية والنظرية لدعم مشروعية تفسيرات درجات الاختبار وتطبيقاتها العملية. إن صدق البناء هو التجسيد الفلسفي والمنهجي لأمانة العلم ومسؤوليته الأخلاقية تجاه تفسير الظواهر الإنسانية الخفية، وبتطويره تتطور قدرة الإنسانية على فهم ذاتها ودراسة سلوكياتها بدقة وموضوعية وعدالة.
المراجع
- American Educational Research Association, American Psychological Association, & National Council on Measurement in Education. (2014). Standards for educational and psychological testing. American Educational Research Association.
- Campbell, D. T., & Fiske, D. W. (1959). Convergent and discriminant validation by the multitrait-multimethod matrix. Psychological Bulletin, 56(2), 81–105. https://doi.org/10.1037/h0046016
- Cronbach, L. J., & Meehl, P. E. (1955). Construct validity in psychological tests. Psychological Bulletin, 52(4), 281–302. https://doi.org/10.1037/h0040957
- Fornell, C., & Larcker, D. F. (1981). Evaluating structural equation models with unobservable variables and measurement error. Journal of Marketing Research, 18(1), 39–50. https://doi.org/10.1177/002224378101800104
- Messick, S. (1989). Validity. In R. L. Linn (Ed.), Educational measurement (3rd ed., pp. 13–103). Macmillan.
- Messick, S. (1995). Validity of psychological assessment: Validation of inferences from persons’ responses and performances as scientific inquiry into score meaning. American Psychologist, 50(9), 741–749. https://doi.org/10.1037/0003-066X.50.9.741
- Nunnally, J. C., & Bernstein, I. H. (1994). Psychometric theory (3rd ed.). McGraw-Hill.