يمثل الصدق في أدبيات القياس النفسي الركيزة الجوهرية التي تمنح الأدوات الاختبارية شرعيتها العلمية وقيمتها التطبيقية؛ إذ لا يمكن لأي أداة تشخيصية أو مسحية أن تقدم بيانات ذات معنى ما لم تكن تقيس بالفعل ما وُضعت لقياسه. وفي قلب هذا البناء المنهجي، يبرز صدق المحتوى (Content Validity) بوصفه صمام الأمان الأول الذي يضمن تمثيل فقرات الاختبار للنطاق السلوكي والمعرفي المراد تقييمه تمثيلاً شاملاً ومتوازناً. يستعرض هذا المقال المعمق الطبيعة النظرية والمنهجية لصدق المحتوى، محدداته الإحصائية، والفروق الدقيقة التي تميزه عن المفاهيم السيكومترية المجاورة، مقدماً دليلاً أكاديمياً متكاملاً للباحثين والممارسين في العلوم النفسية والتربوية.
المفهوم الإبستمولوجي والتعريف النظري لصدق المحتوى
يُعرَّف صدق المحتوى في سياق القياس السيكومتري بأنه الدرجة التي تمثل بها مفردات أو بنود أداة القياس النطاق المحدد أو المجال السلوكي والمعرفي المراد قياسه تمثيلاً دقيقاً ومتناسباً. لا يُنظر إلى هذا المفهوم على أنه مجرد فحص سطحي للأسئلة، بل هو استقصاء منهجي دقيق في مدى كفاية العينة السلوكية المضمنة في الأداة. عندما يصمم الباحث مقياساً لتقييم ظاهرة نفسية مركبة مثل الاكتئاب أو القلق الاجتماعي، يجب أن تعكس بنود المقياس كافة الأبعاد العاطفية، والمعرفية، والجسدية، والسلوكية لهذه الظاهرة دون إغفال أو تحيز غير مبرر.
يتأسس صدق المحتوى من الناحية الإبستمولوجية على افتراض مفاده أن السلوك الإنساني والسمات النفسية تمتد عبر فضاءات واسعة لا متناهية من الاستجابات المحتملة، ونظراً لاستحالة استيعاب هذه الفضاءات في أداة واحدة، يتعين على المصمم استخلاص عينة ممثلة تمثيلاً بنيوياً لذلك الفضاء. من هنا، يصبح صدق المحتوى بمثابة تقييم احتمالي وإبستمولوجي لمدى تطابق هذه العينة المأخوذة مع الكل النظري المفترض. إذا تضمن المقياس ثغرات في أبعاده، أو ركز بصورة مفرطة على بُعد هامشي على حساب الأبعاد الأساسية، فإن درجات المقياس تفقد قدرتها التفسيرية، مما يؤدي إلى تشويه الاستنتاجات الإكلينيكية والبحثية.
يشدد علماء القياس على أن صدق المحتوى ليس خاصية يكتسبها الاختبار بطريقة آلية، بل هو حكم علمي مبني على أدلة استقرائية واستنباطية رصينة تبدأ منذ اللحظات الأولى لبناء الاختبار. يشمل ذلك التحليل المفاهيمي الدقيق للبناء النظري، والرجوع إلى الأدبيات المستقرة، واستشارة أصحاب الخبرة الأكاديمية والعملية لتحديد حدود النطاق وتفاصيله الدقيقة. بالتالي، فإن الحكم على توافر صدق المحتوى يستند إلى الإجابة عن سؤالين محوريين: هل تنتمي جميع البنود إلى النطاق المعرفي المستهدف؟ وهل تغطي هذه البنود مجتمعة جميع مكونات ذلك النطاق دون نقص إقصائي؟
إن إغفال التأسيس الرصين لصدق المحتوى يقود بالضرورة إلى ظاهرة تُعرف في القياس النفسي بـ “نقص التمثيل البنائي” (Construct Underrepresentation) أو “تباين البناء الدخيل” (Construct-Irrelevant Variance). في الحالة الأولى، يفشل الاختبار في قياس أجزاء حيوية من السمة، كأن يقيس مقياس الذكاء الجانب اللغوي ويهمل الجوانب التحليلية والمكانية. وفي الحالة الثانية، يتأثر الاختبار بعوامل خارجية لا علاقة لها بالسمة، مثل الصعوبة اللغوية المفرطة في اختبار يقيس التفكير الرياضي، وهو ما يخل بصدق المحتوى ويفسد دلالات النتائج.
التطور التاريخي لمفهوم صدق المحتوى في القياس السيكومتري
يعود التأصيل التاريخي لمفهوم صدق المحتوى إلى منتصف القرن العشرين، وتحديداً مع التحولات الكبرى التي شهدها ميدان التقييم التربوي والنفسي خلال وبعد الحرب العالمية الثانية. في بدايات حركة القياس، كان التركيز منصباً بصورة شبه حصرية على الصدق المرتبط بالمحك (Criterion-related Validity)، حيث كان الهم الأساسي هو التنبؤ بنجاح الأفراد في مهام وظيفية أو تدريبية محددة. ومع ذلك، سرعان ما تبين للعلماء أن التنبؤ الإحصائي وحده غير كافٍ لتفسير السلوك المعرفي أو الحكم على استيعاب المتعلمين للبرامج التعليمية.
شهد عام 1954 نقطة تحول مفصلية بصدور التوصيات الفنية المشتركة للاختبارات النفسية والتربوية برعاية الجمعية الأمريكية لعلم النفس (APA). تضمنت تلك التوصيات تصنيف الصدق إلى أربعة أنواع رئيسية: الصدق التنبؤي، والتلازمي، والتكويني (بناء الفرضيات)، وصدق المحتوى. تم التركيز في تلك المرحلة على صدق المحتوى كمعيار أساسي لتقييم التحصيل الأكاديمي واختبارات الكفاءة المهنية، حيث كان الهدف ينصب على التحقق من أن بنود الاختبار تمثل عينة مطابقة لمنهج دراسي محدد أو مهام وظيفية موصوفة.
مع تطور النظريات السيكومترية خلال سبعينيات وثمانينيات القرن الماضي، وبخاصة أعمال المنظر السيكومتري البارز صامويل ميسيك (Samuel Messick)، خضع مفهوم الصدق لإعادة هيكلة جذرية شاملة. جادل ميسيك بأن الصدق مفهوم موحد ومترابط، وأن صدق المحتوى ليس مجرد نوع مستقل يقف بذاته، بل يمثل دليلاً جوهرياً من أدلة صدق البناء ككل. وقد غيّر هذا المنظور الفلسفي النظرة السائدة؛ إذ تحول التركيز من النظر إلى صدق المحتوى كفحص شكلي لمفردات المنهج إلى اعتباره إطاراً تكاملياً يربط حدود البناء النفسي بالقرائن التجريبية.
في العصر الراهن، عززت المعايير المشتركة الصادرة عن جمعية الأبحاث التربوية الأمريكية والمجلس الوطني للقياس في التعليم (AERA, APA, & NCME) هذا التحول، وأعادت تسمية المفهوم ليصبح “الأدلة المستندة إلى محتوى الاختبار” (Evidence Based on Test Content). يؤكد هذا التأطير المعاصر أن صدق المحتوى يتطلب فحصاً مستمراً وديناميكياً للمنطق الذي يربط محتوى الأداة بالتفسيرات المشتقة من نتائجها، لاسيما في ظل تنوع البيئات الثقافية واللغوية في المجتمعات المعاصرة وتطور فهمنا لطبيعة الظواهر النفسية.
التمييز المفاهيمي: صدق المحتوى مقابل الصدق الظاهري والمفاهيم المجاورة
يقع كثير من الباحثين المبتدئين في خلط مفاهيمي شائع بين صدق المحتوى (Content Validity) والصدق الظاهري (Face Validity)، على الرغم من الفوارق الجوهرية والمنهجية بينهما. يشير الصدق الظاهري إلى المظهر العام للأداة من وجهة نظر المفحوصين أو غير المتخصصين؛ أي مدى وضوح وجدية وملاءمة البنود لأول وهلة. في المقابل، يمثل صدق المحتوى عملية تمحيص صارمة ومنهجية يقودها خبراء متخصصون يستندون إلى جداول مواصفات وأطر نظرية دقيقة لتحديد مدى تمثيل البنود للمجال السلوكي المستهدف.
لا يعتبر الصدق الظاهري دليلاً سيكومترياً يعتد به علمياً لإثبات صحة المقياس؛ فقد يبدو الاختبار صادقاً في ظاهره للمفحوصين ولكنه يفتقر تماماً إلى التغطية المنهجية لمكونات البناء النفسي. وعلى النقيض من ذلك، قد تتطلب بعض الاختبارات النفسية الإكلينيكية، مثل مقاييس الشخصية الإسقاطية أو الاختبارات المشخصة لسمات الانحراف، إخفاء الهدف الحقيقي للبنود لتقليل تأثير المرغوبية الاجتماعية، مما يجعل صدقها الظاهري منخفضاً عن قصد، في حين يظل صدق محتواها عالياً وخاضعاً لدراسات تجريبية عميقة.
كذلك تبرز أهمية التمييز بين صدق المحتوى وصدق البناء (Construct Validity)؛ فبينما يركز الأول على النطاق الخارجي والتمثيل المادي للمفاهيم عبر البنود، يختبر صدق البناء العلاقات الهيكلية والروابط النظرية بين البناء نفسه والمتغيرات النفسية الأخرى. يتطلب صدق البناء أدلة إحصائية متقدمة مثل التحليل العاملي والارتباطات التقاربية والتباعدية، بينما يعتمد صدق المحتوى في المقام الأول على التحليل المنطقي والتقييم الكمي لآراء المحكمين، ويعمل كقاعدة أساسية لا غنى عنها لبناء صدق البناء نفسه.
أما العلاقة بين صدق المحتوى والصدق المرتبط بالمحك (Criterion-related Validity)، فتكمن في أن الأخير يبحث في مدى قدرة درجات الاختبار على التنبؤ بسلوك خارجي محدد في الحاضر (صدق تلازمي) أو المستقبل (صدق تنبؤي). قد يتمتع الاختبار بصدق محك مرتفع إحصائياً، ومع ذلك يعاني من قصور في صدق المحتوى إذا كانت البنود تقيس متغيراً وسيطاً بدلاً من السمة الأصلية. يوضح الجدول المفاهيمي التالي هذه الفروق الأساسية في البيئة السيكومترية:
- الصدق الظاهري: تقييم سطحي وغير إحصائي يستند إلى انطباع المفحوصين أو غير المتخصصين حول مدى ملاءمة الأداة.
- صدق المحتوى: تقييم منهجي ومعياري يقوم به خبراء متخصصون للتحقق من التغطية الشاملة والمتوازنة للنطاق السلوكي.
- صدق البناء: تقييم إحصائي ونظري لمدى مطابقة الأداة للبناء الفرضي وشبكة العلاقات الارتباطية مع المفاهيم الأخرى.
- الصدق المرتبط بالمحك: تقييم تجريبي للعلاقة الإحصائية بين درجات الاختبار ومحك خارجي واقعي مستقل.
الخطوات الإجرائية والمنهجية لبناء والتحقق من صدق المحتوى
إن التحقق من صدق المحتوى عملية بنيوية تراكمية تبدأ قبل صياغة أول فقرة في المقياس، وتتطلب الالتزام بخطوات منهجية صارمة لضمان موثوقية الأداة الناتجة. تتمثل الخطوة الأولى في التحديد الدقيق لنطاق البناء النفسي (Domain Specification). يتطلب هذا الإجراء مراجعة نقدية واسعة للأدبيات العلمية المنشورة، وفحص النماذج النظرية المعتمدة، وتفكيك السمة النفسية إلى أبعادها ومكوناتها الأولية وتحديد حدودها الفاصلة التي تمنع تداخلها مع سمات أخرى متشابهة.
تتمثل الخطوة الثانية في بناء جدول المواصفات (Table of Specifications)، وهو المخطط الهندسي الذي يحدد الوزن النسبي لكل بُعد من أبعاد السمة المستهدفة. يساعد جدول المواصفات في تحديد عدد البنود المطلوبة لكل مكون استناداً إلى أهميته النسبية في النظرية، ونوعية الاستجابة المطلوبة (معرفية، وجدانية، سلوكية). يمنع هذا الجدول الباحث من الإفراط في التركيز على جوانب يسهل قياسها وإهمال جوانب جوهرية أخرى أكثر تعقيداً، مما يضمن توازناً بنيوياً داخلياً للاختبار.
تأتي بعد ذلك الخطوة الثالثة وهي صياغة المفردات وتطويرها (Item Generation)؛ حيث يجب كتابة بنود واضحة، لا لبس فيها، وتخلو من الازدواجية اللغوية أو الأخطاء التعبيرية التي قد تحرف استجابة المفحوص. من المستحسن في هذه المرحلة صياغة عدد من البنود يفوق العدد النهائي المخطط له بنسبة تتراوح بين 30% إلى 50%، مما يتيح هامشاً نقدياً لاستبعاد الفقرات الضعيفة أو غير الدقيقة بناءً على تقييمات الخبراء والمراجعات اللاحقة دون التأثير على التوازن الهيكلي للأداة.
تتمثل الخطوة الرابعة والأهم في تقييم الخبراء واستطلاع آرائهم (Expert Panel Review). يقوم الباحث باختيار لجنة متخصصة من المحكمين ذوي الخبرة المعمقة في البناء النفسي قيد القياس وطرائق القياس السيكومتري. يُعطى المحكمون دليلاً مفصلاً يتضمن تعريف البناء، وأبعاده، وتعليمات الاختبار، ومقاييس التقييم المعيارية للحكم على مدى صلة (Relevance)، وأهمية (Essentiality)، ووضوح (Clarity) كل بند بالنطاق المخصص له، تمهيداً لحساب المؤشرات الكمية.
النماذج الإحصائية والكمية لتقدير صدق المحتوى
لم يعد تقييم صدق المحتوى يقتصر على المراجعة الكيفية الانطباعية لآراء المحكمين، بل تطور ليشمل معادلات ومؤشرات رياضية دقيقة تسمح باتخاذ قرارات موضوعية بشأن الاحتفاظ بالبنود أو تعديلها أو حذفها. من أقدم هذه النماذج وأكثرها شيوعاً نموذج نسبة صدق المحتوى (Content Validity Ratio – CVR) الذي طوره الباحث تشارلز لوشي (C. H. Lawshe) في عام 1975 لتحديد القيمة الضرورية لكل بند من منظور لجان الخبراء.
في نموذج لوشي، يُطلب من كل خبير تصنيف كل بند وفق مقياس ثلاثي: “ضروري” (Essential)، “مفيد ولكنه غير ضروري” (Useful but not essential)، أو “غير ضروري” (Not necessary). تُحسب نسبة CVR وفق المعادلة الرياضية التالية: حيث تمثل $n_e$ عدد الخبراء الذين أشاروا إلى أن البند ضروري، و$N$ هو إجمالي عدد الخبراء المشاركين. تتراوح قيمة النسبة بين -1.00 و+1.00؛ وتشير القيمة الموجبة التي تتجاوز الصفر إلى أن أكثر من نصف الخبراء اعتبروا البند ضرورياً لقياس النطاق.
تخضع قيمة CVR لمعايير دلالة إحصائية صارمة ترتبط مباشرة بحجم عينة الخبراء لتلافي تأثير الصدفة؛ فكلما صغر عدد المحكمين، ارتفعت القيمة الحرجة المطلوبة لقبول البند. على سبيل المثال، إذا تألفت اللجنة من 5 خبراء فقط، فيجب أن يجمعوا جميعاً على أن البند ضروري ($CVR = 1.00$) لاعتباره مقبولاً إحصائياً، بينما تنخفض هذه القيمة الحرجة إلى 0.42 إذا كانت اللجنة تتألف من 30 خبيراً وفق جداول لوشي المعيارية. يمكن بعد ذلك حساب مؤشر صدق المحتوى الكلي للاختبار (Content Validity Index – CVI) عبر استخراج متوسط قيم CVR للبنود المحتفظ بها.
إلى جانب نموذج لوشي، طور باحثون مثل لين (Lynn) وبوليت وبيك (Polit & Beck) منهجية أخرى لحساب مؤشر صدق المحتوى (CVI) استناداً إلى مقياس ليكرت رباعي الدرجات لتقييم صلة البند (1 = غير ذي صلة، 2 = يحتاج إلى تعديل كبير ليكون ذا صلة، 3 = ذو صلة ولكن يحتاج إلى تعديل طفيف، 4 = ذو صلة تامة). يُقسم هذا المؤشر إلى نوعين رئيسيين يكمل أحدهما الآخر:
- مؤشر صدق محتوى البند (I-CVI): يمثل النسبة المئوية للخبراء الذين قيموا البند بمنحه درجة 3 أو 4؛ ويُشترط عادة ألا يقل عن 0.78 للجان المكونة من 6 إلى 10 خبراء لاعتبار البند ممتازاً من حيث الصلة.
- مؤشر صدق محتوى المقياس ككل (S-CVI): يُحسب إما عبر حساب نسبة البنود التي نالت إجماعاً تاماً من الخبراء (S-CVI/UA)، أو عبر أخذ متوسط درجات I-CVI لجميع بنود الأداة (S-CVI/Ave)؛ وتعتبر الأداة متمتعة بصدق محتوى عالٍ إذا بلغت قيمة S-CVI/Ave ما لا يقل عن 0.90.
تحديات وتحيزات فحص صدق المحتوى في البحوث النفسية
على الرغم من الترسانة المنهجية المتاحة، يواجه فحص صدق المحتوى تحديات نقدية عديدة في التطبيق العملي للبحوث النفسية والاجتماعية. يكمن التحدي الأول في تحيز اختيار الخبراء (Expert Panel Bias). إن مصطلح “خبير” ليس موحداً بشكل مطلق؛ فاختيار أكاديميين ينتمون إلى مدرسة فكرية محددة قد يؤدي إلى استبعاد أبعاد نظرية بديلة للظاهرة قيد القياس، كما أن تباين خبرات المحكمين العملية مقارنة بالأكاديمية يمكن أن يفرز تقييمات متناقضة تتطلب إدارة منهجية واعية.
يرتبط التحدي الثاني بظاهرة التحيز الإدراكي للمحكمين مثل ميل بعضهم إلى التساهل المفرط لمنح درجات قبول عالية تحرجاً من انتقاد جهد الباحث، أو العكس بميل آخرين إلى التشدد غير المبرر بناءً على تفضيلات شخصية لغوية وليست سيكومترية. كما يؤدي الإرهاق الذهني للمحكمين، لاسيما عند مراجعة مقاييس طويلة تتضمن مئات البنود، إلى تراجع دقة الأحكام تدريجياً عبر صفحات الاستبيان، مما يجعل التقييمات المعطاة للبنود اللاحقة أقل موثوقية من الأولى.
يتجسد التحدي الثالث في المعضلة الثقافية وسياقية المفاهيم (Cultural and Contextual Relativity). عندما يُترجم مقياس نفسي من بيئة غربية إلى بيئات غير غربية (كالسياق العربي)، لا يكفي الاعتماد على الترجمة العكسية لضمان صدق المحتوى؛ فالأبعاد السلوكية للأعراض النفسية مثل التعبير عن الحزن أو التعبير عن اضطراب الصدمة تتأثر بالسياق الاجتماعي والديني والتعبيرات الاصطلاحية المحلية. قد تكون البنود دقيقة لغوياً ولكنها تفتقر تماماً إلى الكفاية المضمونية لتمثيل السلوك كما يُمارس فعلياً في تلك الثقافة.
أخيراً، تبرز مسألة ديناميكية البناء النفسي في عصر التحول الرقمي السريع؛ حيث تشهد بعض الظواهر، مثل التنمر أو الإدمان، تحولات جذرية في قنواتها ومظاهرها السلوكية نتيجة لظهور المنصات الرقمية. تصبح المقاييس التي تأسس صدق محتواها استناداً إلى أدبيات تقليدية مهددة بفقدان صلاحيتها التمثيلية إذا لم تخضع لمراجعات تحديثية مستمرة تعيد فحص حدود النطاق وتضمن تضمين مظاهر السلوك الرقمي المستجد في بنودها.
تطبيقات صدق المحتوى في المجالات الإكلينيكية والتربوية والتنظيمية
تتجلى الأهمية العملية لصدق المحتوى في قطاعات تطبيقية متنوعة تترتب على نتائج القياس فيها قرارات مصيرية تؤثر على الأفراد والمؤسسات. في المجال الإكلينيكي والتشخيصي، يعد صدق المحتوى متطلباً حتمياً لأدوات مثل الدليل التشخيصي والإحصائي للاضطرابات النفسية (DSM-5). إذا لم يغطِ مقياس تشخيصي ما جميع المعايير المعتمدة للاضطراب، فقد يسفر ذلك عن أخطاء تشخيصية فادحة من قبيل الإيجابية الكاذبة أو السلبية الكاذبة، مما يعرض سلامة المريض للخطر ويقوض التدخل العلاجي المناسب.
في المجال التربوي والتعليمي، يشكل صدق المحتوى الأساس الجوهري لاختبارات التحصيل المعرفي، والاختبارات الوطنية المقننة، وامتحانات القبول الجامعي. يضمن صدق المحتوى هنا أن الامتحانات المدرسية أو الجامعية تغطي نواتج التعلم المستهدفة ومستويات بلوم المعرفية (تذكر، فهم، تطبيق، تحليل، تركيب، تقييم) بشكل متوازن يتسق مع المنهج الدراسي الفعلي. يضمن هذا الإجراء العدالة الأكاديمية ويمنع مواقف التقييم التي تعاقب الطلاب على محتوى لم يُدرج ضمن نطاق التغطية التدريسية المقررة.
في علم النفس الصناعي والتنظيمي، يلعب صدق المحتوى دوراً حيوياً ومحمياً بموجب القانون في اختبارات التوظيف واختيار القيادات وتحديد كفاءات الترقي. يتطلب القانون في العديد من الدول إثبات أن الاختبارات المستخدمة لتقييم المتقدمين تستند إلى تحليل شامل لمهام الوظيفة (Job Analysis). إذا رسب أحد المرشحين بناءً على اختبار لا يمثل محتواه المهام الحقيقية للعمل، فإن المنظمة تصبح عرضة لمساءلات قانونية وقضائية بتهمة التمييز غير المبرر؛ مما يجعل صدق المحتوى دفاعاً قانونياً وأخلاقياً للمؤسسات المهنية.
المعايير الدولية الحديثة: منظور الأدلة المستندة إلى محتوى الاختبار
وفقاً لأحدث التحديثات الصادرة في معايير الاختبارات التربوية والنفسية (Standards for Educational and Psychological Testing)، تم الانتقال نهائياً من النظر إلى الصدق كـ “أنواع” منفصلة ومجزأة إلى اعتباره مفهوماً وحدوياً شاملاً يُدعم بأنماط متعددة من الأدلة التجريبية والنظرية. في هذا الإطار الحديث، تُعرف الأدلة المستندة إلى محتوى الاختبار بأنها التحليل المنهجي للموضوعات، والشكل، وصياغة الأسئلة، والإجراءات المتبعة في صياغة الاختبار وإدارته وتصحيحه، ومدى تمثيلها للبناء المستهدف.
تركز هذه المعايير الحديثة على ضرورة التحقق من عدة جوانب إضافية لم تكن تحظى بذات الاهتمام سابقاً، ومنها ملاءمة تنسيق الاستجابة (Response Format). على سبيل المثال، إذا كان النطاق المستهدف يتضمن تقييم قدرات اتخاذ القرار تحت الضغط في بيئة إكلينيكية، فإن الاكتفاء بأسئلة الاختيار من متعدد قد لا يوفر دليلاً كافياً على صدق المحتوى؛ بل يتعين تضمين سيناريوهات محاكاة واقعية تتطابق بنيوياً مع طبيعة العمليات الذهنية المطلوبة في الواقع الميداني.
تؤكد المعايير الدولية كذلك على ضرورة توثيق عملية فحص المحتوى في تقرير فني شامل ومتاح للجمهور العلمي. يجب أن يفصح هذا التقرير عن تفاصيل تشكيل لجان التحكيم، ومعايير أهليتهم، وتعليمات التقييم الموجهة إليهم، وحسابات CVR وCVI المجدولة، والمسوغات المنطقية لتعديل أو استبقاء أي بند نال درجات متدنية. إن هذا الالتزام بالشفافية المنهجية يعزز الثقة في الأدوات ويوفر إمكانية تكرار الدراسات التحققية في سياقات وثقافات متباينة.
خاتمة
يظل صدق المحتوى الخطوة التأسيسية التي لا غنى عنها في بنية القياس النفسي والتربوي، إذ يمثل الجسر المنهجي الذي يربط بين النظرية المجردة في العقل البشري والتمثيل الإجرائي في أدوات الملاحظة والتقييم. إن الالتزام بالصرامة المنهجية في توثيق صدق المحتوى، بدءاً من التعريف الدقيق للنطاق السلوكي وصولاً إلى التحليل الكمي المنظم لآراء الخبراء، ليس مجرد ترف إحصائي بل هو التزام علمي وأخلاقي يضمن موثوقية القرارات النفسية، والطبية، والتربوية، والوظيفية، ويحمي الأفراد من تبعات التقييم القاصر أو المشوه.
المراجع
- American Educational Research Association, American Psychological Association, & National Council on Measurement in Education. (2014). Standards for educational and psychological testing. American Educational Research Association.
- Lawshe, C. H. (1975). A quantitative approach to content validity. Personnel Psychology, 28(4), 563–575. https://doi.org/10.1111/j.1744-6570.1975.tb01393.x
- Lynn, M. R. (1986). Determination and quantification of content validity. Nursing Research, 35(6), 382–385. https://doi.org/10.1097/00006199-198611000-00017
- Messick, S. (1989). Validity. In R. L. Linn (Ed.), Educational measurement (3rd ed., pp. 13–103). Macmillan.
- Polit, D. F., & Beck, C. T. (2006). The content validity index: Are you sure you know what’s being reported? Critique and recommendations. Research in Nursing & Health, 29(5), 489–497. https://doi.org/10.1002/nur.20147
- Sireci, S., & Faulkner-Bond, M. (2014). Validity evidence based on test content. Psicothema, 26(1), 100–107. https://doi.org/10.7334/psicothema2013.180