يقف صدق البناء (Construct Validity) كأحد أهم الركائز الإبستمولوجية والمنهجية في حقل علم النفس والقياس السيكومتري المعاصر، إذ يمثل المعيار الذهبي الذي يحدد مدى نجاح الأداة الاختبارية في قياس المفهوم النظري المجرد الذي وُضعت لقياسه بدقة وموثوقية. لا يمكن لأي باحث أو ممارس إكلينيكي أن يثق في النتائج التشخيصية أو الفرضيات البحثية دون برهان تجريبي ومنهجي قاطع يثبت أن درجات الاختبار تعكس بالفعل السمة النفسية المستهدفة، وليس مجرد متغيرات دخيلة أو تشويش عشوائي. من هنا، لا يُعد صدق البناء مجرد خاصية إحصائية جامدة تلحق بأداة القياس، بل هو سيرورة برهانية مستمرة ونشاط استقصائي يدمج بين النظرية النفسية والتحليل الإحصائي الرصين.
المفهوم الفلسفي والمنهجي لصدق البناء الفرضي
يُعرَّف صدق البناء في أدبيات القياس النفسي بأنه الدرجة التي تدعم بها الأدلة التجريبية والأسس النظرية ملاءمة التفسيرات والاستدلالات المستخلصة من درجات الاختبارات النفسية والتربوية. في العلوم الطبيعية، يتعامل العلماء غالبًا مع كيانات قابلة للملاحظة المباشرة مثل الطول أو الكتلة، في حين يتعامل علماء النفس مع “تكوينات فرضية” (Hypothetical Constructs) غير قابلة للملاحظة العينية المباشرة، مثل: الذكاء، والاكتئاب، وتقدير الذات، والانبساطية، والقلق العصابي. هذه التكوينات ليست أشياء مادية ملموسة، بل هي مفاهيم مجردة استنتجها المنظرون لتفسير أنماط السلوك البشري الملاحظ والاستجابات الانفعالية والمعرفية المتكررة.
تنبثق الرؤية الحديثة لصدق البناء من التحول الإبستمولوجي الذي قاده العالمان لي كرونباخ (Lee Cronbach) وبول ميل (Paul Meehl) في ورقتهما العلمية التاريخية المنشورة عام 1955. بيّن الباحثان أن صدق البناء يصبح المطلب الجوهري والوحيد عندما لا يوجد معيار خارجي محدد ومباشر (Criterion) يمكن الرجوع إليه للتحقق من صدق الدرجة، وعندما لا يمكن حصر السمة في مجموعة محددة من الأسئلة أو العبارات ذات الصدق المحتوى فقط. وعليه، فإن صدق البناء يرتبط ارتباطًا وثيقًا بالتحقق من صحة النظرية النفسية ذاتها التي تستند إليها الأداة؛ فإذا فشل المقياس في إثبات صدقه، فإن المشكلة قد تكمن إما في سوء صياغة فقرات المقياس، أو في خلل جوهري في الفرضيات النظرية المؤسسة للسمة برمتها.
ينطوي صدق البناء على تبني منظور تكاملي يتجاوز فكرة النظر إلى الصدق كـ “خاصية حتمية يمتلكها الاختبار”؛ فالصواب علميًا هو أن نتحدث عن “صدق تفسيرات درجات الاختبار لغرض وسياق محددين”. وهذا يعني أن الاختبار لا يكون “صادقًا” بصورة مطلقة أو نهائية، بل تظل صلاحية درجاته قائمة على حجم وقوة الأدلة والبراهين التراكمية التي تدعم تفسيرها النظري واستخدامها في بيئة ثقافية أو مجتمعية محددة. يربط هذا المنظور بين الاستقصاء النظري والممارسة الإمبريقية، جاعلاً من عملية بناء المقاييس عملية علمية ديناميكية مستمرة تخضع للمراجعة والتطوير الدائمين.
الجذور التاريخية وتطور حركة القياس السيكومتري
مر مفهوم الصدق في القياس النفسي بمراحل تطور جذرية عبر القرن العشرين، حيث سادت في البدايات مقاربات اختزالية تركز فقط على الفائدة البراغماتية للاختبارات دون الاهتمام بطبيعة التكوين النفسي الكامن وراء الأداء. في الأربعينيات وأوائل الخمسينيات من القرن الماضي، كان التركيز السيكومتري موجهًا نحو شقين رئيسيين: صدق المحتوى (Content Validity) القائم على مطابقة بنود الاختبار للأهداف التعليمية أو السلوكية، والصدق المرتبط بالمحك (Criterion-related Validity) الذي يهتم فقط بالقدرة على التنبؤ بدرجة الفرد على معيار محدد، كالتنبؤ بالنجاح الوظيفي أو الأكاديمي، بغض النظر عما يقيسه الاختبار في جوهره النفسي الداخلي.
شكّل عام 1954 نقطة تحول حاسمة عندما أصدرت جمعية علم النفس الأمريكية (APA) توصياتها التقنية للاختبارات النفسية والتربوية، حيث تم لأول مرة إدراج “صدق البناء” كفئة متميزة بجانب صدق المحتوى والصدق التنبئي والصدق التلازمي، مشكّلة ما عُرف لاحقًا بـ “الثالوث التقليدي للصدق” (Trinitarian View of Validity). وجاءت ورقة كرونباخ وميل عام 1955 لترسخ الأساس الفلسفي لهذا المفهوم، معتمدة على فلسفة الوضعية المنطقية وتيار التجريبية المنطقية لربط المفاهيم الكامنة بالمؤشرات التجريبية القابلة للقياس الميداني المباشر.
شهدت العقود اللاحقة نضجًا مفاهيميًا هائلاً، قاده صامويل ميسيك (Samuel Messick) في ثمانينيات القرن العشرين، والذي أطاح بالتقسيم الثلاثي التقليدي للصدق، معلنًا أن “صدق البناء هو الصدق بمجمله”. في منظور ميسيك الموحد، لا تشكل الأشكال الأخرى للصدق سوى أدلة رافدة ومصادر متنوعة للبراهين تصب جميعها في مجرى واحد وهو التحقق من البناء الفرضي. لقد حول هذا المنظور المتكامل عملية الصدق من مجرد حساب معاملات ارتباط إحصائية روتينية إلى تقييم حجاجي وتبريري يتضمن حتى التداعيات الاجتماعية والقيمية والأخلاقية الناتجة عن تطبيق الاختبار وتفسير نتائجه في أرض الواقع.
نظرية الشبكة الاسمية (Nomological Network) ودورها التأسيسي
تُعد الشبكة الاسمية (Nomological Network) الإطار النظري الأعمق الذي ابتكره كرونباخ وميل لإرساء صدق البناء، وهي مأخوذة من الكلمة اليونانية “Nomos” التي تعني القانون؛ أي أنها شبكة من القوانين والعلاقات المنطقية المنظمة للظاهرة النفسية. تنطلق هذه الفكرة من مبدأ علمي مفاده أن المفهوم النظري لا يكتسب معناه ودلالته العلمية في معزل عن سياقه؛ بل يكتسب معناه من خلال موقعه ضمن شبكة متكاملة من الروابط التي تجمعه بغيره من المفاهيم التجريدية وبالملاحظات الإمبريقية السلوكية الملموسة.
تتألف الشبكة الاسمية من ثلاثة مستويات من الروابط الإبستمولوجية الأساسية التي يجب أن تتكامل معًا لتأسيس الصدق:
- الروابط بين التكوينات النظرية وبعضها: مثل الفرضية القائلة بأن مفهوم “المرونة النفسية” يرتبط إيجابيًا بمفهوم “التنظيم الانفعالي” ويرتبط عكسيًا بمفهوم “العصابية”.
- الروابط بين التكوينات النظرية والمؤشرات السلوكية الملاحظة: مثل الفرضية التي تقرر أن الأفراد ذوي الدرجات المرتفعة في “قلق الاختبار” يُظهرون استجابات فسيولوجية محددة مثل تسارع ضربات القلب والتعرق، وسلوكيات ملاحظة مثل التردد في الإجابة أو تجنب أداء الامتحانات.
- الروابط بين المؤشرات الملاحظة وبعضها البعض: والتي تعكس الاتساق والترابط الإحصائي الداخلي بين مختلف الأدوات والأساليب المستخدمة لجمع البيانات الميدانية حول السلوك المعني.
إن بناء هذه الشبكة الاسمية يلزم الباحث بوضع تنبؤات مسبقة ودقيقة تنبع مباشرة من النظرية النفسية التأسيسية. وعند تطبيق المقياس وجمع البيانات الإمبريقية، يقوم الباحث باختبار مدى تطابق العلاقات الملاحظة في الواقع مع العلاقات التي تنبأت بها الشبكة الاسمية نظريًا. إذا تطابقت البيانات مع التنبؤات، فإن ذلك يقدم برهانًا تراكميًا قويًا على صدق البناء للأداة، ويثبت في الوقت ذاته جدارة النظرية النفسية في تفسير الواقع السلوكي للإنسان.
الأوجه التمايزية والتقاربية: مصفوفة السمات المتعددة والطرق المتعددة
في عام 1959، قدّم دونالد كامبل (Donald Campbell) ودونالد فيسك (Donald Fiske) إسهامًا منهجيًا فارقًا في فهم صدق البناء، حيث قاما بتقسيم أدلة هذا الصدق إلى وجهين متكاملين لا غنى لأحدهما عن الآخر: الصدق التقاربي (Convergent Validity) والصدق التمايزي (Discriminant Validity). يقوم الصدق التقاربي على فرضية أن المقاييس المختلفة التي صُممت لقياس البناء النفسي ذاته، أو أبنية مشابهة له إلى حد كبير، يجب أن ترتبط فيما بينها ارتباطًا إحصائيًا موجبًا وقويًا، حتى وإن اختلفت أساليب القياس ومصادر جمع البيانات المستخدمة.
في المقابل، يمثل الصدق التمايزي الجانب الآخر الحاسم، ويشترط ألا يرتبط المقياس ارتباطًا قويًا بالمفاهيم والأبنية النفسية الأخرى التي يُفترض نظريًا استقلالها واختلافها عنه. فعلى سبيل المثال، إذا كان الباحث يطور مقياسًا جديدًا لقياس “الكآبة”، فإن الصدق التقاربي يقتضي أن ترتبط درجات المقياس ارتباطًا وثيقًا بمقاييس الكآبة المعترف بها عالميًا، مثل قائمة بيك للاكتئاب. في حين يقتضي الصدق التمايزي ألا يرتفع الارتباط بين مقياس الكآبة ومقياس “القلق العام” إلى درجات تجعل من المستحيل التمييز إحصائيًا بين السمتين، مؤكدًا بذلك استقلالية مفهوم الكآبة عن الحالات الانفعالية المتداخلة معها.
ولوضع هذا التمييز في إطار تطبيقي تجريبي صارم، ابتكر كامبل وفيسك أسلوب مصفوفة السمات المتعددة والطرق المتعددة (Multitrait-Multimethod Matrix – MTMM). يتطلب هذا النموذج قياس سمتين مختلفتين على الأقل (كالقلق والاكتئاب) باستخدام طريقتين مختلفتين على الأقل للقياس (كالتقرير الذاتي وتقييم الأقران أو المقابلة الإكلينيكية). توفر هذه المصفوفة أداة تحليلية بصرية وإحصائية تسمح للباحثين بالفصل الدقيق بين “تباين السمة” الحقيقي المراد قياسه، و”تباين الطريقة” (Method Variance) الناتج عن أسلوب القياس نفسه، مما يكشف إذا ما كان التشابه في الدرجات راجعًا لتشابه السلوك أم للتحيز الناشئ عن طريقة التقييم المتبعة.
المقاربات الإحصائية والتحليلية لاختبار صدق البناء
مع التطور التقني والمنهجي في علم الإحصاء التطبيقي، باتت تتوافر للباحثين ترسانة من الأدوات الإحصائية المتقدمة للتحقق من صدق البناء، يأتي في مقدمتها التحليل العاملي (Factor Analysis) بنوعيه: الاستكشافي (Exploratory Factor Analysis – EFA) والتوكيدي (Confirmatory Factor Analysis – CFA). يُستخدم التحليل العاملي الاستكشافي في المراحل الأولى لتطوير الأدوات للكشف عن الأبعاد أو العوامل الكامنة التي تنتظم حولها استجابات الأفراد، مما يساعد على تحديد الهيكل البنائي الداخلي للبيانات الأولية.
أما التحليل العاملي التوكيدي (CFA)، فيمثل التقنية المعيارية الأقوى لاختبار صدق البناء من الناحية الإحصائية. ففي هذا الإجراء، لا يترك الباحث الحاسوب يستخرج العوامل بصورة آلية، بل يقوم بصياغة نموذج نظري قبلي (A priori model) يحدد فيه بدقة مسارات العلاقات بين الفقرات الملاحظة والأبعاد الكامنة، استنادًا إلى النظرية النفسية التأسيسية. وباستخدام مؤشرات جودة المطابقة (Goodness-of-Fit Indices) مثل مؤشر المطابقة المقارن (CFI) ومربع كاي المعياري وجذر متوسط مربعات خطأ الاقتراب (RMSEA)، يتم التحقق مما إذا كانت البيانات الميدانية تتطابق فعليًا مع الهيكل النظري المفترض للاختبار.
بالإضافة إلى التحليل العاملي، تلعب نماذج المعادلات البنائية (Structural Equation Modeling – SEM) دورًا محوريًا من خلال دمج نماذج القياس بالنماذج البنائية في آن واحد، مما يتيح اختبار الفرضيات المعقدة والشبكات الاسمية كاملة مع الأخذ في الحسبان أخطاء القياس (Measurement Error). كما تقدم نظرية الاستجابة للمفردة (Item Response Theory – IRT) أفقًا متقدمًا عبر فحص دالة أداء المفردة وخصائصها البارامترية، والتحقق من افتراض أحادية البعد (Unidimensionality)، والتأكد من خلو البنود من الأداء التفاضلي للمفردة (Differential Item Functioning – DIF) لضمان عدالة وصدق القياس عبر الفئات السكانية المختلفة.
نموذج ميسيك التكاملي الموحد لصدق القياس
يمثل إطار صامويل ميسيك (Messick, 1989) الثورة المعرفية الأبرز في فهم البناء السيكومتري، حيث تجاوز المقاربات المجزأة السابقة مقترحًا نموذجًا تكامليًا موحدًا يرتكز على ستة أوجه بنيوية متداخلة، يساهم كل منها بدليل حيوي لدعم صدق البناء العام لأي مقياس:
- الوجه المحتوي (Content Aspect): يرتبط بمدى شمولية بنود الاختبار ومطابقتها لمجال التكوين الفرضي المستهدف، مع التأكد من وضوح الصياغة اللغوية وملاءمة الأداء المطلوب، مستندًا إلى آراء الخبراء المتخصصين والمحكمين.
- الوجه الجوهري/العملياتي (Substantive Aspect): يركز على العمليات العقلية والأنماط السلوكية التي ينخرط فيها المفحوصون بالفعل أثناء استجابتهم لبنود الاختبار، للتأكد من أن الأداء يتطلب العمليات النفسية المفترضة نظريًا (كالتفكير الناقد أو معالجة الذاكرة) وليس استراتيجيات بديلة كالتخمين.
- الوجه الهيكلي/البنائي (Structural Aspect): يختص بالتحقق من أن الهيكل العاملي الداخلي للاختبار وطرق تسجيل الدرجات وحساب الأوزان تعكس تمامًا البنية الداخلية للتكوين النفسي النظري (سواء كان أحادي البعد، أو متعدد الأبعاد المتعامدة أو المائلة).
- وجه التعميم (Generalizability Aspect): يفحص مدى ثبات واستقرار درجات الاختبار واستنتاجاته عبر مختلف السياقات الزمنية، ومجموعات الأفراد، والشروط البيئية، وطرق التطبيق المختلفة دون أن تفقد دلالتها المعيارية.
- الوجه الخارجي (External Aspect): يغطي أدلة الصدق التقاربي والتمايزي والارتباط بالمحكات الخارجية المتوقعة ضمن الشبكة الاسمية الموسعة للمفهوم قيد الدراسة.
- الوجه التبعي/العواقبي (Consequential Aspect): يمثل الإضافة الجوهرية والفريدة لفكر ميسيك، إذ يلزم الباحث بتقييم الآثار المجتمعية، والأخلاقية، والسياسية المترتبة على استخدام المقياس وتفسير درجاته، والتحقق من عدم تسببه في إلحاق الضرر أو التمييز غير العادل ضد فئات معينة.
أعاد نموذج ميسيك صياغة سؤال الصدق السيكومتري؛ فلم يعد السؤال هو: “هل يقيس هذا الاختبار ما وُضع لقياسه فحسب؟”، بل أصبح: “إلى أي مدى تُعد التفسيرات والاستخدامات والقرارات المنبثقة عن نتائج هذا الاختبار مبررة علميًا وأخلاقيًا وتجريبيًا؟”. يفرض هذا النموذج مسؤولية مستمرة على عاتق مطوري الاختبارات والمستخدمين على حد سواء لرصد النتائج العواقبية للاختبارات النفسية والتربوية في المجتمع.
المهددات المنهجية والانحيازات المؤثرة في صدق البناء
تواجه عملية إثبات صدق البناء العديد من التحديات والمهددات المنهجية التي يمكن أن تشوه التفسيرات المستخلصة من الاختبارات وتضعف قوتها الاستدلالية. حدد الباحثون مهددين جوهريين هما الأبرز في أدبيات القياس: نقص تمثيل البناء (Construct Underrepresentation) والتباين غير المرتبط بالبناء (Construct-Irrelevant Variance). يمثل هذان الخطأان الوجهين المتعاكسين لأزمة الصدق السيكومتري الداخلي.
يحدث نقص تمثيل البناء عندما يكون المقياس ضيقًا للغاية ومحدود الأفق مقارنة بالسعة الحقيقية للتكوين النفسي المستهدف، مما يؤدي إلى إغفال أبعاد وجوانب حرجة للمفهوم. على سبيل المثال، إذا صُمم اختبار لقياس “الذكاء الوجداني” وركزت بنوده حصرًا على بُعد “إدراك الانفعالات”، متجاهلة أبعادًا حاسمة أخرى مثل “تنظيم الانفعالات” و”التعاطف” و”توظيف الانفعال في حل المشكلات”، فإن المقياس يقع في فخ نقص التمثيل البنائي؛ حيث تصبح الدرجات عاجزة عن تقديم صورة كاملة وعادلة عن قدرة الفرد الحقيقية في هذا المجال المعقد.
على النقيض من ذلك، يقع التباين غير المرتبط بالبناء عندما يقيس الاختبار -عن غير قصد- متغيرات وسمات أخرى لا علاقة لها بالتكوين المستهدف، مما يُقحم شوائب إحصائية في تباين الدرجات. من أمثلة ذلك صياغة فقرات اختبار يقيس “التفكير الرياضي” بلغة شديدة التعقيد والتكلف البلاغي؛ في هذه الحالة، يتأثر أداء المفحوصين بمهاراتهم القرائية واللغوية بدلاً من قدراتهم الرياضية البحتة، مما يجعل جزءًا كبيرًا من تباين الدرجات تباينًا شائبًا ومضللاً لا ينتمي إلى بناء التفكير الرياضي المنشود.
تتفاقم هذه المهددات بوجود مصادر أخرى للانحياز مثل: “انحياز الأسلوب الأحادي” (Mono-operation Bias) الناجم عن الاعتماد على مؤشر مفرد لقياس ظاهرة معقدة، و”انحياز الطريقة الأحادية” (Mono-method Bias) المترتب على استخدام أداة جمع بيانات واحدة (كالاستبانات الذاتية دون غيرها)، فضلاً عن انحياز المرغوبية الاجتماعية (Social Desirability) وتأثيرات هالة المفحوص أو الفاحص، والتي تتطلب جميعها ضبطًا منهجيًا صارمًا وتصميمات بحثية متعددة المستويات لتطويقها والحد من آثارها السلبية على صدق النتائج.
تطبيقات صدق البناء في التقييم الإكلينيكي والتربوي والمهني
يحمل صدق البناء أهمية بالغة وأثرًا فاصلاً في الممارسات التشخيصية في علم النفس السريري وعلم النفس المرضي. فعند تطبيق أدوات مثل مقياس منيسوتا متعدد الأوجه للشخصية (MMPI) أو مقاييس تشخيص اضطراب فرط الحركة وتشتت الانتباه (ADHD)، يترتب على تفسير الدرجات قرارات مصيرية تشمل خطط العلاج الدوائي، أو الإيداع في المؤسسات العلاجية، أو تحديد الأهلية الجنائية. إن غياب صدق البناء في هذه السياقات قد يقود إلى تشخيصات خاطئة كارثية تصم المفحوصين وتدمر مسارات حياتهم النفسية والاجتماعية.
في الميدان التربوي والتعليمي، يستند تقييم التحصيل والقدرات العقلية والمهارات الأكاديمية (مثل اختبارات قياس القدرات العامة، واختبارات القبول الجامعي الوطنية والدولية) إلى افتراض أن الدرجة تمثل بدقة الاستعداد المعرفي الكامن للطالب. يتطلب إرساء صدق البناء في هذه البيئات التحقق من أن الاختبار لا يميز بشكل منهجي أو متحيز ضد فئات اجتماعية أو اقتصادية أو لغوية معينة، وأن المحتوى يقيس بالفعل نواتج التعلم العليا كالفهم والتحليل وحل المشكلات بدلاً من مجرد قياس الاسترجاع الآلي الصم والذاكرة السطحية.
يمتد التطبيق الحيوي كذلك إلى ميدان علم النفس الصناعي والتنظيمي، حيث تعتمد المؤسسات الكبرى على اختبارات الشخصية والنزاهة وتقييمات الكفاءة القيادية لاختيار الموظفين والترقيات الإدارية. في هذا الإطار، يضمن صدق البناء أن سمة مثل “الضمير الحي” (Conscientiousness) تقاس بنقاء وموثوقية، وأن الارتباط الملاحظ بينها وبين الأداء الوظيفي يعكس كفاءة إنتاجية حقيقية، مما يحمي المنظمات من القرارات التوظيفية غير الموفقة ومن المساءلات القانونية المرتبطة بالتمييز غير العادل في بيئات العمل المعاصرة.
آفاق القياس النفسي في العصر الرقمي والذكاء الاصطناعي
يشهد القياس النفسي اليوم نقلة نوعية كبرى بالتزامن مع الثورة الرقمية وتطبيقات الذكاء الاصطناعي وتعدين البيانات السلوكية الضخمة (Big Data). لقد أفسح القياس الورقي التقليدي المجال أمام القياس التكيفي المحوسب (Computerized Adaptive Testing – CAT)، والتقييم النفسي القائم على الألعاب الرقمية (Game-Based Assessment)، وتحليل البصمات الرقمية والنصوص المنشورة على منصات التواصل الاجتماعي للتنبؤ بالسمات الشخصية والميول الانفعالية للأفراد.
تفرض هذه التطورات التكنولوجية المتسارعة تحديات إبستمولوجية غير مسبوقة على صدق البناء؛ فالخوارزميات المعقدة ونماذج التعلم العميق قد تنجح في إنتاج تنبؤات إحصائية دقيقة وعالية الارتباط بالسلوك، ولكنها تظل في كثير من الأحيان بمثابة “صناديق سوداء” تفتقر إلى الأساس النظري والتفسيري المفهومي الواضح. يثير هذا التباين إشكالية عميقة: هل يمكننا التحدث عن صدق البناء لأداة تقييم ذكية تعجز خوارزمياتها عن تفسير السمة النفسية الكامنة في إطار نظري منظم؟
لذا، تبرز في الأدبيات المعاصرة دعوات ملحة لإعادة تأطير صدق البناء في بيئات الذكاء الاصطناعي والقياس الرقمي التكيفي. تتطلب هذه المرحلة الجديدة من الباحثين النفسيين الجمع بين تقنيات الحوسبة المتقدمة ونماذج النمذجة النفسية القابلة للتفسير (Explainable AI – XAI)، للتأكد من أن البيانات الرقمية المجمعة تترجم بالفعل أبنية ومفاهيم نفسية أصيلة، والحرص على حماية الخصوصية ومكافحة الانحيازات الخوارزمية التي قد تعيد إنتاج التمييز الاجتماعي وتضر بصدق القياس وموثوقيته الأخلاقية.
خاتمة استنتاجية
يظل صدق البناء بمثابة البوصلة الأخلاقية والمنهجية التي تمنح درجات القياس النفسي معناها وقيمتها العلمية في الممارسة والأبحاث. إنه ليس مجرد ختم توثيقي أو معادلة حسابية تُنجز لمرة واحدة، بل هو مسار مستمر من التقصي والتفنيد والبرهان العلمي التراكمي، يربط المفاهيم النظرية الكامنة بالظواهر السلوكية العينية في عالم الواقع. من خلال الفهم الشامل لشبكاته الاسمية، وتطوير أساليب التحليل العاملي ونماذج المعادلات البنائية، وتوظيف الإطار التكاملي الموحد، يستطيع علماء النفس والباحثون تطوير أدوات قياس دقيقة ورصينة تصمد أمام التمحيص الإمبريقي وتخدم الأهداف الإنسانية والتربوية والتشخيصية بكفاءة وأمانة علمية تامة.
المراجع
- American Educational Research Association, American Psychological Association, & National Council on Measurement in Education. (2014). Standards for educational and psychological testing. American Educational Research Association.
- Campbell, D. T., & Fiske, D. W. (1959). Convergent and discriminant validation by the multitrait-multimethod matrix. Psychological Bulletin, 56(2), 81–105. https://doi.org/10.1037/h0046016
- Cronbach, L. J., & Meehl, P. E. (1955). Construct validity in psychological tests. Psychological Bulletin, 52(4), 281–302. https://doi.org/10.1037/h0040957
- Kline, R. B. (2016). Principles and practice of structural equation modeling (4th ed.). Guilford Press.
- Messick, S. (1989). Validity. In R. L. Linn (Ed.), Educational measurement (3rd ed., pp. 13–103). Macmillan.
- Messick, S. (1995). Validity of psychological assessment: Validation of inferences from persons’ responses and performances as scientific inquiry into score meaning. American Psychologist, 50(9), 741–749. https://doi.org/10.1037/0003-066X.50.9.741
- Smith, G. T. (2005). On construct validity: Issues of method and measurement. Psychological Assessment, 17(4), 396–408. https://doi.org/10.1037/1040-3590.17.4.396
- علام، صلاح الدين محمود. (2000). القياس والتقويم التربوي والنفسي: أساسياته وتطبيقاته وتوجهاته المعاصرة. دار الفكر العربي.
- أبو حطب، فؤاد، وصادق، آمال. (1996). مناهج البحث وطرق التحليل الإحصائي في العلوم النفسية والتربوية والاجتماعية. مكتبة الأنجلو المصرية.