الإحصاء النفسيالقياس النفسيمناهج البحث في علم النفس

المقارنة البعدية في القياس النفسي والإحصاء التجريبي

دليل أكاديمي شامل حول المقارنة البعدية (A Posteriori Comparison) في الإحصاء النفسي: الأسس الرياضية، معالجة خطأ النوع الأول، ومعايير اختيار الاختبارات البعدية مثل توكي وبونفيروني وشيفيه.

Mohammed looti أكاديمي وباحث متخصص في علم النفس
تاريخ النشر
تمت المراجعة العلمية · د. مروة عبد العظيم · 25 سبتمبر، 2026
مراجعة وتدقيق علمي معتمد تاريخ التدقيق: 25 سبتمبر، 2026
د. مروة عبد العظيم دكتوراه
أستاذة علم النفس • جامعة كربلاء
معايير التدقيق والاعتماد السريري

يخضع هذا المحتوى لمعايير ضبط الجودة والتدقيق العلمي والأكاديمي الصارمة في شبكة علم النفس العربي، لضمان صحة المعلومات ودقتها السريرية ومطابقتها لأحدث الأدلة والبراهين الصادرة عن الجمعيات النفسية والطبية المعتمدة (APA / WHO).

تمثل المقارنة البعدية (A Posteriori Comparison أو ما يُعرف إحصائياً بالاختبارات البعدية Post-Hoc Tests) ركيزة منهجية جوهرية في تحليل البيانات الكمية ضمن نطاق علم النفس التجريبي والعلوم السلوكية. تنبثق الحاجة الماسة إلى هذه المقارنات عندما يُجري الباحث النفسي تحليلاً للتباين الأحادي أو المتعدد، ويتوصل إلى وجود دلالة إحصائية عامة تشير إلى اختلاف جوهري بين مجموعات التجربة دون تحديد دقيق لمواضع هذا التباين. من هنا، تأتي المقارنات البعدية كأداة استكشافية استقصائية تُطبق بأثر رجعي، أي بعد فحص البيانات وملاحظة النتائج الإجمالية، لتشريح العلاقات المتبادلة بين المتوسطات الحسابية بدقة متناهية ودون الوقوع في مصيدة الاستنتاجات الزائفة.

مقدمة وتعريف مفاهيمي: ماهية المقارنة البعدية في البحث النفسي

تُعرّف المقارنة البعدية في أدبيات القياس النفسي والإحصاء الاستدلالي بأنها مجموعة من الإجراءات الإحصائية المصممة لاختبار الفروق بين أزواج أو مجموعات فرعية من المتوسطات بعد رفض الفرضية الصفرية في اختبار إحصائي شامل مثل تحليل التباين (ANOVA). يحمل المصطلح دلالة فلسفية ومعرفية مستمدة من اللاتينية، حيث تعني عبارة “A posteriori” ما هو مستند إلى الخبرة والملاحظة اللاحقة، على النقيض تماماً من المقارنات القبلية القائمة على تنبؤات مسبقة. في السياق النفسي، تُستخدم هذه الاختبارات عندما لا يمتلك الباحث فرضية محددة سلفاً بخصوص أي من المجموعات التجريبية ستتفوق على غيرها، بل يسعى لاكتشاف الأنماط غير المتوقعة التي تفرزها الظاهرة النفسية قيد الدراسة.

يواجه الباحث السلوكي عند فحص تباين استجابات الأفراد عبر شروط تجريبية متعددة معضلة ترتبط بطبيعة الظواهر النفسية المعقدة، مثل استجابة القلق لجرعات علاجية متفاوتة أو تباين الكفاءة المعرفية باختلاف فئات الأعمار. عندما يشير اختبار التباين الكلي إلى وجود تأثير رئيسي ذي دلالة إحصائية، يظل هذا التأثير غامضاً ومبهماً؛ إذ يكتفي بالإقرار بأن المتوسطات ليست جميعها متساوية في المجتمع الإحصائي الأصلي، دون أن يحدد بدقة أي المتوسطات يختلف عن الآخر، أو ما إذا كان الفارق يكمن بين المجموعة الضابطة والمجموعات العلاجية مجتمعة، أم بين التدخلات العلاجية فيما بينها. هنا تحديداً تتدخل المقارنة البعدية لتحويل الدلالة الإحصائية العامة غير المحددة إلى استنتاجات تفصيلية ذات معنى إكلينيكي ونظري ملموس.

إن الوظيفة المحورية للمقارنات البعدية لا تقتصر على مجرد إجراء اختبارات متعددة للمقارنة بين كل زوج من الأزواج، بل تتعدى ذلك إلى حماية الباحث من تضخم الدلالة الإحصائية الزائفة. ففي غياب الضبط المنهجي الصارم، تؤدي المقارنات العشوائية والمتكررة بين المتوسطات إلى زيادة احتمالية ارتكاب الخطأ من النوع الأول، وهو ما يقود إلى قبول فرضيات زائفة حول فاعلية علاج نفسي أو وجود فروق جوهرية في السمات الشخصية لا وجود لها في الواقع. بالتالي، فإن المقارنة البعدية تعد بمثابة صمام أمان إبستمولوجي يوازن بين رغبة الباحث في استكشاف البيانات بحرية وبين الانضباط الرياضي المطلوب لضمان موثوقية النتائج وإمكانية تكرارها علمياً.

السياق التاريخي وتطور الاختبارات البعدية في علم النفس

يعود التأصيل التاريخي لمفهوم المقارنات البعدية إلى الربع الأول من القرن العشرين، متزامناً مع الثورة المنهجية التي أحدثها السير رونالد فيشر عند صياغته لأسس تحليل التباين والتصميم التجريبي. أدرك فيشر مبكراً أن مقارنة عدة مجموعات تجريبية تتطلب معياراً إحصائياً موحداً لتجنب إجراء اختبارات الفروق الثنائية التقليدية المتكررة. ومع ذلك، قدم فيشر في البداية ما يُعرف باختبار “الفروق المعنوية الصغرى” (Fisher’s Least Significant Difference – LSD)، والذي اعتُبر لاحقاً غير كافٍ لتوفير الحماية الإحصائية الصارمة في حال زيادة عدد المجموعات المقارنة، مما حفز علماء الإحصاء النفسي والرياضي على ابتكار بدائل أكثر تحفظاً ودقة.

شهدت حقبة الخمسينيات من القرن العشرين طفرة استثنائية في تطوير التقنيات البعدية، بقيادة قامات علمية بارزة تركت بصماتها على القياس النفسي، مثل جون توكي (John Tukey) وهنري شيفيه (Henry Scheffé) وديفيد دانكن (David Duncan). جاءت أبحاث جون توكي لتضع معياراً ذهبياً جديداً من خلال تطوير اختبار “الفرق ذي الدلالة الحقيقية” (Tukey’s HSD)، الذي صُمم خصيصاً لمقارنة جميع الأزواج المحتملة مع تثبيت صارم لمعدل الخطأ التجريبي. في الوقت نفسه تقريباً، صاغ شيفيه طريقته الرياضية المرنة والقادرة على استيعاب المقارنات المعقدة والتوليفات الخطية المتعددة بين المجموعات، حتى في ظل التباين في حجوم العينات، مما منح علماء النفس التجريبي أدوات متطورة لمواكبة التعقيد المتزايد في تصميماتهم البحثية.

مع تطور حركة علم النفس المعرفي والإكلينيكي في النصف الثاني من القرن العشرين، والانتقال نحو الدراسات متعددة العوامل والتصميمات المتقاطعة، تطورت تقنيات المقارنة البعدية لتشمل معالجة المشكلات المتعلقة بخرق الافتراضات الإحصائية الكلاسيكية. برزت نماذج جديدة أخذت بعين الاعتبار غياب تجانس التباين، مثل اختبار جيمس-ハウيل (Games-Howell)، بالإضافة إلى اختبارات متخصصة تقارن مجموعات تجريبية متعددة مقابل مجموعة ضابطة واحدة كاختبار دانيت (Dunnett’s test). يعكس هذا المسار التاريخي نضوج الرؤية الإحصائية في العلوم النفسية، حيث تحول الباحثون من التركيز البسيط على استخراج الدلالة الإحصائية المجردة إلى تقدير أحجام الأثر، وضبط الأخطاء، والتعامل مع البيانات المعقدة بدرجة عالية من الدقة المنهجية.

الأسس الرياضية: إشكالية تضخم خطأ النوع الأول ومعدل الخطأ الأسري

لفهم الأساس النظري والرياضي الذي تُبنى عليه المقارنات البعدية، ينبغي استيعاب الإشكالية الإحصائية المركزية المعروفة باسم تضخم خطأ النوع الأول (Type I Error Inflation). في الاختبارات الإحصائية الفردية، يحدد الباحث عادة مستوى الدلالة أو ألفا (α) بقيمة 0.05، وهو ما يعني أن احتمالية رفض الفرضية الصفرية بالخطأ (أي ادعاء وجود تأثير لا وجود له فعلياً) تبلغ 5%. ولكن عندما يتضمن التصميم التجريبي أربع مجموعات على سبيل المثال، فإن عدد المقارنات الزوجية المحتملة يصل إلى ست مقارنات وفق القاعدة الرياضية [k(k-1)/2]، حيث يمثل k عدد المجموعات، مما يغير من طبيعة حساب الاحتمالات الكلية بشكل جذري.

تخضع هذه المقارنات المتعددة لقوانين الاحتمالات التراكمية، حيث يُعرّف معدل الخطأ العائلي أو الأسري (Family-Wise Error Rate – FWER) بأنه احتمالية ارتكاب خطأ واحد على الأقل من النوع الأول عبر جميع المقارنات التي يجريها الباحث ضمن نفس التجربة. يُحسب هذا المعدل الرياضي من خلال المعادلة: αFWER = 1 - (1 - α)c، حيث تمثل c عدد المقارنات المستقلة المنفذة. فإذا كان لدينا 6 مقارنات بمستوى ألفا اسمي قدره 0.05، فإن معدل الخطأ الأسري الحقيقي يرتفع إلى قرابة 1 - (0.95)6 ≈ 0.265، أي أن هناك احتمالاً يتجاوز 26% لظهور نتيجة دالة إحصائياً بالصدفة البحتة، وهو ما يقوض الثقة العلمية في نتائج البحث النفسي.

تعمل خوارزميات المقارنات البعدية على تعديل القيمة الحرجة للاختبار، أو تعديل قيمة الاحتمالية المحسوبة (p-value)، من أجل الحفاظ على معدل الخطأ الأسري ثابتاً عند المستوى المرغوب (كالنسبة 0.05) بغض النظر عن عدد المقارنات المنجزة. تختلف الطرق الرياضية في كيفية تحقيق هذا التوازن؛ فبعضها يتبنى منهجيات شديدة الصرامة والتحفظ تقسم ألفا بالتساوي على عدد المقارنات، في حين تعتمد طرق أخرى على استنتاج توزيع المدى المعياري الطلابي (Studentized Range Distribution) لاحتساب القيم الحرجة، مما يتيح ضبط معدل الخطأ دون التضحية المفرطة بالقوة الإحصائية (Statistical Power) للاختبار.

المقارنات القبلية مقابل المقارنات البعدية: التمايز المعرفي والإجرائي

يشكل التمييز بين المقارنات القبلية (A Priori Comparisons / Planned Contrasts) والمقارنات البعدية (A Posteriori Comparisons) فاصلاً إبستمولوجياً ومنهجياً حاسماً في تصميم التجارب النفسية. تُبنى المقارنات القبلية على أطر نظرية متينة وفرضيات محددة بدقة قبل جمع البيانات أو فحصها تجريبياً. على سبيل المثال، إذا كانت النظرية المعرفية تتنبأ بأن استراتيجية العلاج بالتقبل والالتزام ستتفوق تحديداً على العلاج السلوكي التقليدي في خفض مستويات الاجترار الفكري، فإن الباحث يصمم مقابلة موجهة مسبقاً لاختبار هذا الفرض بعينه، مما يسمح باستخدام اختبارات ذات قوة إحصائية عالية ودون الحاجة لتعديلات صارمة على مستوى الدلالة.

في المقابل، تتسم المقارنات البعدية بطبيعتها الاستكشافية وتستخدم لاصطياد الفروق المحتملة بين كافة المجموعات التي شملتها الدراسة بعد ظهور النتائج. لا تتطلب هذه المقارنات تنبؤاً مسبقاً، بل تُفعل عادةً بعد التحقق من معنوية اختبار تحليل التباين الكلي. ولأن الباحث يقوم في هذه الحالة بفحص جميع التوليفات المحتملة بحثاً عن الفروق ذات الدلالة، فإن المعايير الإحصائية تفرض عليه ضريبة منهجية تتمثل في تقليص القوة الإحصائية وفرض قيود أكثر صرامة لاجتياز عتبة الدلالة، تعويضاً عن غياب التوجيه النظري القبلي.

يوضح الجدول النظري التالي الفروق الجوهرية بين المدخلين، حيث يظهر الفارق في المنطلقات الفلسفية، والإجراءات الإحصائية، ونطاق التطبيق في القياس النفسي:

  • التوقيت المنهجي: تُحدد المقارنات القبلية في مرحلة تصميم البحث وقبل تفريغ البيانات، بينما تُحدد وتُنفذ المقارنات البعدية بعد استعراض النتائج ورفض الفرضية الصفرية العامة.
  • المرجعية النظرية: تستند المقارنات المخططة إلى فرضيات اشتقاقية دقيقة مستمدة من النظريات السيكولوجية، في حين تستند المقارنات البعدية إلى استكشاف البيانات واكتشاف العلاقات الكامنة غير المتوقعة.
  • القوة الإحصائية: تتمتع المقارنات القبلية بقوة إحصائية أعلى وقدرة أكبر على رصد التأثيرات الحقيقية الصغيرة، بينما تتميز المقارنات البعدية بتحفظ إحصائي أعلى لحماية التحليل من أخطاء العينات العشوائية.
  • المرونة التطبيقية: تقتصر المقارنات القبلية على عدد محدود من الفرضيات لا يتجاوز عادة درجات الحرية للمجموعات، بينما توفر المقارنات البعدية حرية كاملة لاختبار كافة الأزواج والتركيبات الممكنة.

تصنيف وأبرز طرائق المقارنة البعدية في علم النفس

تتعدد الاختبارات البعدية المتاحة لعلماء النفس وتتفاوت فيما بينها من حيث الفلسفة الرياضية ومستوى التحفظ وشروط التطبيق؛ إذ لا يوجد اختبار واحد يصلح لكافة السيناريوهات والبيانات. تتباين هذه الاختبارات بين طرائق مفرطة في التحفظ تهدف إلى حماية قصوى ضد الخطأ من النوع الأول، وطرائق تميل إلى التحرر وتمنح وزناً أكبر لتقليل خطأ النوع الثاني، مما يبرز أهمية الفهم المعمق لخصائص كل أسلوب قبل اعتماده في تحليل النتائج التجريبية.

1. اختبار توكي للفرق ذي الدلالة الحقيقية (Tukey’s HSD)

يعد اختبار توكي (Tukey’s Honestly Significant Difference) الأسلوب الأكثر انتشاراً وتفضيلاً في البحوث النفسية الكلاسيكية، وتحديداً عند الرغبة في إجراء مقارنات زوجية شاملة بين جميع المجموعات المتضمنة في الدراسة. يعتمد الاختبار على توزيع المدى المعياري الطلابي بدلاً من توزيع t التقليدي، ويحسب قيمة حرجة واحدة تُقارن بها الفروق المطلقة بين أي متوسطين حسابيين. يتميز اختبار توكي بقدرته الفائقة على الحفاظ بدقة على معدل الخطأ الأسري عند مستوى 0.05، شريطة تحقق افتراض اعتدالية البيانات وتساوي حجوم العينات في المجموعات المقارنة.

2. تعديل بونفيروني (Bonferroni Correction)

يستند إجراء بونفيروني إلى منطق رياضي بسيط ومباشر يتمثل في قسمة مستوى الدلالة الكلي المحدد (α) على إجمالي عدد المقارنات المنفذة (k)، بحيث تصبح العتبة المطلوبة لكل اختبار هي α / k. وعلى الرغم من سهولة تطبيقه ومرونته الفائقة في التعامل مع أي نوع من المقارنات، إلا أنه يُعد من أشد الأساليب تحفظاً على الإطلاق. يؤدي هذا التحفظ الشديد في الدراسات النفسية التي تشتمل على عدد كبير من المجموعات إلى تقليل القوة الإحصائية بشكل مفرط، مما يزيد من احتمالية الوقوع في الخطأ من النوع الثاني وتجاهل فروق علاجية أو سلوكية حقيقية ذات مغزى تجريبي.

3. اختبار شيفيه (Scheffé’s Method)

يمثل اختبار شيفيه الخيار الأكثر شمولاً ومرونة عندما لا تقتصر رغبة الباحث على المقارنات الزوجية البسيطة (مجموعة مقابل مجموعة)، بل تمتد لتشمل المقارنات المركبة والتوليفات المعقدة (على سبيل المثال: مقارنة متوسط مجموعتي العلاج المعرفي والعلاج الدوائي مجتمعتين في مواجهة المجموعة الضابطة). يتميز هذا الاختبار بحصانته المطلقة وثباته العالي حتى في حال عدم تساوي أحجام العينات، غير أن مرونته العالية تأتي على حساب القوة الإحصائية للمقارنات الزوجية المباشرة، حيث يصعب على الاختبار رصد الفروق البسيطة بين الأزواج الفردية مقارنة باختبار توكي.

4. اختبار دانيت (Dunnett’s Test)

صُمم اختبار دانيت خصيصاً ليناسب طبيعة التجارب الإكلينيكية والدوائية النفسية التي تحتوي على مجموعة ضابطة واحدة (Control Group) في مقابل عدة مجموعات تتلقى تدخلاً تجريبياً أو برامج علاجية مختلفة. بدلاً من استنزاف درجات الحرية في إجراء مقارنات غير ضرورية بين المجموعات التجريبية فيما بينها، يركز دانيت جهده الإحصائي حصراً على مقارنة كل مجموعة تجريبية بالمجموعة الضابطة المرجعية، مما يرفع القوة الإحصائية ويوفر حماية دقيقة لمعدل الخطأ الأسري في مثل هذه التصاميم الموجهة.

5. اختبار جيمس-هاويل (Games-Howell Test)

في الكثير من الأبحاث النفسية الميدانية، يواجه الباحث انتهاكاً صريحاً لافتراض تجانس التباين (Homoscedasticity) أو عدم تساوي أحجام العينات بصورة واضحة، كأن تكون العينة الإكلينيكية للاضطرابات النادرة أصغر بكثير من عينة الأفراد الأصحاء. في مثل هذه الظروف، تفقد اختبارات توكي وبونفيروني دقتها وتصبح مضللة. يبرز اختبار جيمس-هاويل كحل إحصائي متين (Robust) مصمم للتعامل بكفاءة مع التباينات غير المتجانسة والعينات غير المتساوية، معتمداً على درجات حرية معدلة مستمدة من تقريب ولش (Welch’s t-test)، مما يجعله الخيار الأمثل للبيانات الواقعية المضطربة.

شروط وافتراضات تطبيق المقارنات البعدية في النماذج السلوكية

يتطلب التطبيق العلمي السليم للمقارنات البعدية استيفاء حزمة من الافتراضات الإحصائية والمنهجية التي تضمن صحة الاستدلالات المشتقة وموثوقية القرارات البحثية المتخذة بناءً عليها. إن التغاضي عن هذه الافتراضات أو التعامل معها كشكليات إجرائية يؤدي في غالب الأحيان إلى انحراف النتائج وتشويه التقديرات الإحصائية، مما يجعل تفسير الظاهرة النفسية مشوباً بعيوب منهجية خطيرة تضر بجودة البحث العلمي ورصانته.

يتمثل الافتراض الأول في اعتدالية التوزيع (Normality) للمتغير التابع ضمن كل فئة من فئات المتغير المستقل في المجتمع الأصلي. على الرغم من أن اختبارات التباين تظهر درجة معينة من المقاومة للخرق الطفيف للاعتدالية في ضوء نظرية النهاية المركزية مع حجوم العينات الكبيرة، إلا أن الالتواءات الشديدة في درجات القياس النفسي (مثل مقاييس الاكتئاب السريري التي تميل بطبيعتها إلى الالتواء الإيجابي الحاد في المجتمعات غير الإكلينيكية) تفرض على الباحثين استخدام تحويلات رياضية للبيانات أو اللجوء إلى اختبارات بعدية لامعلمية بديلة مثل اختبار دان (Dunn’s test) الملحق باختبار كروسكال-واليس.

أما الافتراض الثاني فيتعلق بـ تجانس التباين (Homogeneity of Variance)، والذي يفترض أن تشتت الدرجات حول المتوسط متساوٍ تقريباً عبر جميع المجموعات التجريبية. يتحقق الباحث النفسي من هذا الشرط عادةً باستخدام اختبار ليفين (Levene’s Test)؛ وفي حال سقوطه والوصول إلى دلالة تشير لعدم التجانس، يتعين على الباحث تجنب الاختبارات البعدية الكلاسيكية القائمة على افتراض التباين المشترك (كـ Tukey و Scheffé)، والتحول فوراً نحو الاختبارات المعدلة التي تراعي عدم تجانس التباين، لضمان عدم تضخيم احتمالية الخطأ وتزوير الفروق الإحصائية.

بالإضافة إلى ذلك، تظل استقلالية الملاحظات (Independence of Observations) حجر الزاوية الذي لا يقبل المساومة في تصميمات المجموعات المستقلة؛ إذ يجب أن تكون درجات كل مفحوص مستقلة تماماً عن درجات بقية الأفراد. في حال استخدام تصميمات القياسات المتكررة (Repeated Measures Designs) التي يُقاس فيها نفس المفحوص عبر أزمنة مختلفة أو تحت ظروف متعددة، تسقط افتراضات الاستقلالية العادية وتبرز شروط أخرى مثل الكروية (Sphericity)، وتتطلب المقارنات البعدية عندئذٍ استخدام نماذج تباين الفروق المصححة مثل تعديل غرينهاوس-غايسر لتفادي التقديرات المتفائلة للتباين.

معايير المفاضلة واختيار الاختبار البعدي المناسب

تضع الأدبيات المنهجية المعاصرة في القياس وعلم النفس الإرشادي خريطة طريق واضحة توجه الباحثين نحو انتقاء الأداة الإحصائية الأكثر اتساقاً مع طبيعة بياناتهم وتصميماتهم التجريبية. تعتمد عملية الاختيار العقلاني على موازنة دقيقة بين التحكم في خطأ النوع الأول من جهة والحفاظ على القوة الإحصائية لاكتشاف التأثيرات من جهة أخرى، ويمكن تلخيص محددات هذه المفاضلة في المعايير المنهجية والعملية الآتية:

  • هدف المقارنة وعدد الأزواج: إذا كان الهدف فحص كافة المقارنات الزوجية الممكنة، فإن اختبار توكي (Tukey’s HSD) يظل الخيار الأمثل. أما إذا كان الهدف مقتصراً على مقارنة مجموعات علاجية بمجموعة ضابطة، فإن اختبار دانيت (Dunnett) يوفر قوة إحصائية متفوقة بفضل تركيزه المتخصص.
  • طبيعة المقارنات (بسيطة أم مركبة): عندما تتضمن أسئلة البحث مقارنة مجموعات مدمجة ومجموعات وزن خطي، يبرز اختبار شيفيه (Scheffé) بوصفه الأسلوب الإحصائي الوحيد القادر على معالجة هذه الفرضيات المعقدة بكفاءة وصرامة رياضية.
  • تجانس التباين وحجم العينات: في حالات التباين غير المتجانس وعدم تكافؤ أعداد المشاركين في المجموعات (وهو أمر شائع في العينات الإكلينيكية)، يعد اختبار جيمس-هاويل (Games-Howell) البديل القوي الذي يوصى به لتفادي الوقوع في استنتاجات خاطئة.
  • مستوى التحفظ الإحصائي المطلوب: في الدراسات الاستكشافية الميدانية الأولية، قد يفضل الباحث استخدام اختبارات ذات تحفظ معتدل لا تخنق النتائج الواعدة، بينما تفرض التجارب السريرية الحساسة لتقييم مضاعفات تدخل نفسي أو دوائي تبني أعلى درجات التحفظ مثل أسلوب بونفيروني المعدل لضمان سلامة الاستنتاجات الطبية والسلوكية.

تطبيقات إكلينيكية وبحثية في العلوم النفسية والمعرفية

تتجلى الأهمية التطبيقية للمقارنات البعدية بصورة لافتة في ميدان أبحاث علم النفس السريري والتقييم النفسي العصبي. لنفترض أن فريقاً بحثياً أجرى تجربة عشوائية محكومة لتقييم فاعلية ثلاثة برامج تدريبية في خفض أعراض اضطراب ما بعد الصدمة (PTSD): برنامج العلاج بالتعرض المطول، وبرنامج معالجة معالجة إزالة التحسس وإعادة المعالجة بحركات العينين (EMDR)، وبرنامج العلاج باليقظة الذهنية، إلى جانب مجموعة رابعة وُضعت على قائمة الانتظار كمجموعة ضابطة.

بعد تطبيق مقياس شدة الصدمة وجمع البيانات، أظهر تحليل التباين الأحادي تأثيراً كلياً دالاً إحصائياً للبرامج العلاجية عند مستوى دلالة p < 0.001. في هذه المرحلة، لا يمكن للفريق الإكلينيكي معرفة ما إذا كانت العلاجات الثلاثة متماثلة في كفاءتها، أو أن أحدها يمتلك تفوقاً نوعياً على البقية، أو إذا كان بعضها لا يختلف جوهرياً عن مجرد وضع المفحوص على قائمة الانتظار. هنا تمثل المقارنة البعدية الخطوة الفارقة؛ إذ يُمكن باستخدام اختبار توكي التحقق من وجود فارق معنوي بين EMDR والعلاج بالتعرض، في حين يُستعان باختبار دانيت للتيقن من أن كل تدخل على حدة يتفوق دلالياً على مجموعة الانتظار، مما يساعد الممارسين على رسم بروتوكولات التدخل العلاجي وفق بينات إحصائية دقيقة.

وفي مجال علم النفس المعرفي، تسهم المقارنات البعدية في فك شفرات العمليات الذهنية المعقدة مثل أوقات الاستجابة في مهام الانتباه الانتقائي كـ “مهمة ستروب” (Stroop Task). من خلال مقارنة أزواج الظروف التجريبية (المتطابقة، غير المتطابقة، والمحايدة) تحت تأثير ظروف إجهاد متباينة (منخفض، متوسط، مرتفع)، تتيح هذه الاختبارات تفكيك التفاعلات الدقيقة بين المتغيرات. إن التحليل البعدي في مثل هذه السياقات يسمح بفهم متى وأين يتأثر التحكم المعرفي بالضغط النفسي، بدلاً من الاكتفاء باستنتاج شامل يشير فقط إلى أن “الضغط يؤثر على الأداء بشكل عام”.

الانتقادات والمزالق المنهجية: صيد البيانات وأزمة التكرار

على الرغم من الأهمية المنهجية الجوهرية للمقارنات البعدية، إلا أنها واجهت انتقادات حادة في العقد الأخير في سياق النقاش الدائر حول ما يُعرف بـ “أزمة التكرار” (Replication Crisis) في العلوم النفسية والاجتماعية. تكمن المعضلة الأساسية في الممارسة غير الأخلاقية أو غير الواعية المعروفة باسم “صيد البيانات” أو تجريف البيانات (Data Dredging / P-hacking)، حيث يعمد بعض الباحثين إلى استعراض مصفوفة هائلة من المقارنات البعدية غير المبررة نظرياً، ثم ينتقون المقارنات التي أفرزت دلالة إحصائية بالصدفة فقط لعرضها في أوراقهم العلمية وكأنها نتائج متوقعة، مما يضلل الأوساط العلمية بفرضيات زائفة.

يرى نقاد المنهج الاستقرائي البحت في القياس السلوكي أن الاعتماد المفرط على المقارنات البعدية دون تأصيل نظري يحول البحث النفسي من مسار “اختبار النظريات وتفنيدها” إلى مجرد مسار “توصيف العينات وجمع المصادفات”. فالبيانات النفسية تحفل بالتقلبات والضوضاء الناتجة عن الفروق الفردية والتباين العشوائي في القياس؛ وبالتالي، فإن إجراء العشرات من المقارنات بحثاً عن أي قيمة p < 0.05 يفرغ المنهج العلمي التجريبي من نزاهته ويجعل من النتائج غير قابلة لإعادة الإنتاج عند تطبيقها على عينات أخرى من نفس المجتمع الأصلي.

وللحد من هذه المنزلقات المنهجية، تؤكد الجمعيات العلمية الرائدة مثل جمعية علم النفس الأمريكية (APA) ضرورة الشفافية المطلقة والإفصاح عن كافة المقارنات التي أُجريت أثناء التحليل، سواء كانت النتائج دالة أو غير دالة. كما يوصي خبراء القياس النفسي المعاصرون بالتحول نحو “التسجيل المسبق” (Preregistration) للخطط التحليلية، إلى جانب تدعيم تقارير المقارنات البعدية بحساب حجم الأثر (Effect Size) مثل مقياس كوهين (Cohen’s d) وفترات الثقة (Confidence Intervals)، لتقييم الأهمية العملية والواقعية للنتائج بدلاً من الاقتصار على الدلالة الإحصائية الاسمية التي قد تظهر بمجرد تضخيم حجم العينة.

خاتمة وتوصيات للباحث السلوكي المعاصر

تظل المقارنة البعدية أداة استدلالية لا غنى عنها في ترسانة المنهجية الإحصائية في علم النفس، حيث تتيح للباحثين سبر أغوار البيانات المعقدة والكشف عن أنماط العلاقات الثنائية والمركبة بدقة وموضوعية بعد التحقق من وجود تباين كلي دال. تتطلب الممارسة المنهجية الرصينة وعياً إحصائياً شاملاً بالفروق الدقيقة بين مختلف الاختبارات، بدءاً من اختبار توكي الصارم وحتى اختبار جيمس-هاويل المتين، بما يضمن انسجام الأداة المختارة مع خصائص العينة وتحقق الافتراضات التوزيعية المرتبطة بها.

إن المسؤولية الإبستمولوجية الملقاة على عاتق الباحث في العلوم النفسية تفرض عليه التمييز الصارم بين مرحلة استكشاف البيانات اللاحقة ومرحلة اختبار الفرضيات النظرية المسبقة، والنأي بالبحث العلمي عن ممارسات التلاعب بالقيمة الاحتمالية. من خلال الالتزام بالشفافية الإحصائية، وضبط معدلات الخطأ التراكمي، ودمج حجوم الأثر وفترات الثقة في التقارير المنشورة، تسهم المقارنات البعدية بصورة فعالة في بناء معرفة تراكمية رصينة ترتقي بفهمنا للسلوك الإنساني والعمليات النفسية وتدعم تطوير التدخلات الإكلينيكية القائمة على البراهين القوية.

المراجع

  • American Psychological Association. (2020). Publication manual of the American Psychological Association (7th ed.). American Psychological Association.
  • Field, A. (2018). Discovering statistics using IBM SPSS statistics (5th ed.). SAGE Publications.
  • Games, P. A., & Howell, J. F. (1976). Pairwise multiple comparison procedures with unequal N’s and/or variances: A Monte Carlo study. Journal of Educational Statistics, 1(2), 113–125. https://doi.org/10.2307/1164979
  • Howell, D. C. (2013). Statistical methods for psychology (8th ed.). Cengage Learning.
  • Maxwell, S. E., Delaney, H. D., & Kelley, K. (2018). Designing experiments and analyzing data: A model comparison perspective (3rd ed.). Routledge.
  • Scheffé, H. (1959). The analysis of variance. John Wiley & Sons.
  • Tabachnick, B. G., & Fidell, L. S. (2019). Using multivariate statistics (7th ed.). Pearson.
  • Tukey, J. W. (1949). Comparing individual means in the analysis of variance. Biometrics, 5(2), 99–114. https://doi.org/10.2307/3001913

اقتباس هذا المقال

looti, M. (2026, سبتمبر 25). المقارنة البعدية في القياس النفسي والإحصاء التجريبي. عرب سايكلوجي. https://arabpsychology.com/dictionary/a-posteriori-comparison-psychological-statistics/
looti, Mohammed. “المقارنة البعدية في القياس النفسي والإحصاء التجريبي.” عرب سايكلوجي, 25 سبتمبر 2026, https://arabpsychology.com/dictionary/a-posteriori-comparison-psychological-statistics/.
looti, Mohammed. “المقارنة البعدية في القياس النفسي والإحصاء التجريبي.” عرب سايكلوجي. سبتمبر 25, 2026. https://arabpsychology.com/dictionary/a-posteriori-comparison-psychological-statistics/.