يشكل المعزز الشرطي (Conditioned Reinforcer)، والذي يُعرف في الأدبيات النفسية بالمعزز الثانوي، حجر الزاوية في فهم وتفسير آليات السلوك الإنساني والحيواني المعقد؛ إذ يكشف عن الكيفية التي تتحول بها المثيرات المحايدة في البيئة إلى محركات دافعية تمتلك سلطة توجيه الأفعال وصياغة العادات. لا يولد الكائن الحي مستجيباً لقيمة المال، أو درجات الثناء، أو الألقاب الأكاديمية بطريقة غريزية فطرية، بل يكتسب هذه الرغبات العارمة عبر سلاسل تفاعلية دقيقة من التعلم والاقتران البيئي المستمر. يقدم هذا المفهوم إطاراً نظرياً وتطبيقياً بالغ الأهمية يربط بين فسيولوجيا الحاجات الأساسية والشبكات الرمزية المعقدة التي تشكل المجتمعات والثقافات البشرية المعاصرة.
التعريف النظري والمفاهيمي للمعزز الشرطي
يُعرف المعزز الشرطي في علم النفس السلوكي بأنه أي مثير بيئي كان محايداً في الأصل (Neutral Stimulus)، ولكنه اكتسب القدرة على تقوية وتكرار السلوك الذي يعقبه من خلال اقترانه المتكرر والمنظم بمثير آخر يمتلك خواص تعزيزية أصيلة تُعرف بـ المعزز الأولي (Primary Reinforcer). في حين ترتبط المعززات الأولية مباشرة بالإشباع البيولوجي والبقاء العضوي، مثل الطعام، والماء، والدفء، والتفريغ الحسي، فإن المعززات الشرطية تستمد شحنتها التحفيزية من تاريخ التعلم الفردي للكائن الحي وعلاقات الاقتران التي اختبرها في بيئته الخاصة. لذلك، يمثل التعزيز الشرطي جسراً معرفياً وسلوكياً ينقل القيمة من النطاق الغريزي البحت إلى الفضاء الرمزي والبيئي المكتسب.
تستند القوة الوظيفية للمعزز الشرطي إلى ديناميكية مزدوجة تتداخل فيها مبادئ الإشراط الكلاسيكي مع قواعد الإشراط الاستثابي؛ فالمثير المحايد يخضع لعملية اقتران بافلوفية تجعله إشارة تنبؤية بحدوث المكافأة الأولية، مما يمنحه قيمة ذاتية تجعله قادراً على العمل كمكافأة مستقلة في سياق السلوك الإجرائي. هذا التحول من “مثير محايد مجرد” إلى “مثير ذي قيمة دافعية” يسمى بعملية التحويل القيمي التنبؤي، حيث يصبح المثير في حد ذاته غاية يسعى الكائن لتحقيقها، وليس مجرد علامة إرشادية عابرة.
من الناحية المنهجية والإجرائية، يقاس نجاح تحول المثير إلى معزز شرطي بقدرته على المحافظة على معدل استجابة مرتفع في غياب المعزز الأولي لفترة زمنية محددة، أو بقدرته على دعم تعلم استجابات سلوكية جديدة كلياً لم تكن موجودة في حصيلة الكائن الحي سابقاً. إذا استطاع صوت نقرة جرس معين، بعد اقترانه بالطعام، أن يدفع فأراً تجريبياً للضغط على رافعة جديدة تماماً لم يتعلم الضغط عليها من قبل دون تقديم طعام، فإن هذا الصوت يُعد حينئذ معززاً شرطياً حقيقياً استقر في بنيته السلوكية.
تتجلى أهمية المعزز الشرطي في مرونته الفائقة وقدرته على تجاوز عوائق الإشباع السريع (Satiation) التي تتسم بها المعززات الأولية؛ فالكائن الحي يتوقف عن الاستجابة للطعام بمجرد امتلائه ووصوله لحالة الشبع الفسيولوجي، في حين أن المعززات الشرطية، وخصوصاً الرمزية منها، تتمتع بمناعة عالية ضد الشبع الفوري، مما يجعلها أداة فعالة للغاية ومستدامة في الضبط والتعليم السلوكي طويل المدى.
الجذور التاريخية والتطور المعرفي للمفهوم
تعود الإرهاصات الأولى لمفهوم التعزيز المشروط إلى الأبحاث الرائدة التي أجراها عالم الفسيولوجيا الروسي إيفان بافلوف في أوائل القرن العشرين؛ فرغم تركيز بافلوف الأساسي على المنعكسات اللعابية البسيطة، إلا أنه لاحظ ظاهرة بالغة الأهمية أطلق عليها اسم الإشراط من الدرجة الأعلى (Higher-Order Conditioning). لاحظ بافلوف أن المثير الشرطي الذي تم تثبيت استجابته عبر اقترانه بالطعام يمكن استخدامه كمثير غير شرطي لتدريب الكلب على مثير محايد جديد، مما أثبت بشكل قاطع أن المثيرات المكتسبة تستطيع نقل خصائصها التحفيزية عبر مستويات متتالية من الترابط الترابطي.
مع بزوغ فجر المدرسة السلوكية الراديكالية في الولايات المتحدة، أعاد عالم النفس الشهير بي إف سكينر صياغة هذا المفهوم في إطار السلوك الإجرائي من خلال مؤلفه التأسيسي “سلوك الكائنات” الصادر عام 1938. ميز سكينر بوضوح بين المعززات ذات الأثر البيولوجي المباشر وتلك التي تكتسب فاعليتها عبر سلاسل الاستجابة الإجرائية المتتالية (Chaining). أوضح سكينر أن كل حلقة في سلسلة سلوكية معقدة تعمل بوصفها مثيراً تمييزياً للاستجابة التالية، وفي الوقت ذاته، كمعزز شرطي للاستجابة التي سبقتها مباشرة، مما فسر لأول مرة كيف يمكن بناء مهارات متسلسلة ومعقدة للغاية لدى الإنسان والحيوان.
في أربعينيات وخمسينيات القرن العشرين، حاول كلارك هال (Clark Hull) وكينيث سبنس (Kenneth Spence) دمج المعزز الشرطي ضمن نظرية تخفيض الدافع (Drive Reduction Theory). جادل أصحاب هذه المدرسة بأن المثير يكتسب صفة التعزيز الشرطي عندما يقترن بتراجع في التوتر البيولوجي أو زوال الألم، بينما عارض باحثون لاحقون مثل نيل ميلر (Neal Miller) هذا التفسير الحصري، مؤكدين أن التعزيز المشروط يمكن أن يكتسب قوته من خلال تعلم الخوف أو الحوافز الإيجابية دون الحاجة لتخفيض دافع عضوي كامل ومباشر.
شهدت العقود الأخيرة تحولاً نوعياً في فهم المعزز الشرطي من خلال نظريات التعلم المعرفي وعلم الأعصاب الإدراكي، حيث لم يعد يُنظر إليه كأثر آلي أصم يربط المثير بالاستجابة، بل كبنية تمثيلية معرفية يطور الفرد من خلالها توقعات عقلية ونماذج داخلية للعالم الخارجي. برهنت أعمال روبرت ريسكورلا وألان واغنر (Rescorla-Wagner Model) على أن القيمة المشروطة لا تتشكل بمجرد الاقتران الزمني الميكانيكي، بل تعتمد جوهرياً على القيمة الإخبارية (Informativeness) والتنبؤية للمثير وقدرته على تقليل عدم اليقين لدى الكائن الحي.
آليات تشكل المعزز الشرطي ومحددات فاعليته
يرتكز تشكل المعزز الشرطي على مجموعة من المحددات والقوانين البارامترية الدقيقة التي تتحكم في عمق وثبات القيمة التحفيزية المستحدثة. أول هذه المحددات هو الاقتران الزمني والارتباط التنبؤي؛ فالفاصل الزمني بين ظهور المثير المحايد وتقديم المعزز الأولي يلعب دوراً حاسماً، حيث ثبت تجريبياً أن الإشراط الأمامي المتزامن أو المتأخر بفارق طفيف للغاية هو الأكفأ في نقل القيمة التعزيزية، بينما يفشل الإشراط الرجعي (تقديم المعزز الأولي قبل المثير المحايد) في إكساب المثير أي شحنة تعزيزية ملحوظة.
يرتبط المحدد الثاني بـ جداول التعزيز (Schedules of Reinforcement) المطبقة أثناء مرحلة الاقتران؛ فالمثيرات التي تقترن بالمعززات الأولية على نحو متقطع (Intermittent Reinforcement) تميل إلى إظهار مقاومة شديدة جداً لظاهرة الانطفاء (Resistance to Extinction) مقارنة بتلك التي تقترن على نحو مستمر؛ فالتقطع يولد لدى الكائن حساسية استجابية مستمرة ويقلل من توقع الخذلان الحتمي، مما يجعل المعزز الشرطي قادراً على تغذية السلوك لفترات طويلة حتى في حال غياب المعزز الأولي بصورة مؤقتة أو متباعدة.
يتجسد المحدد الثالث في مفهوم الحرمان والتشبع النسبي؛ فعلى الرغم من أن المعززات الشرطية تظهر استقلالية نسبية، إلا أن قوتها تظل خاضعة على المدى الطويل لحالة الحرمان من المعززات الأولية المرتبطة بها تاريخياً. إذا ارتبط المثير الشرطي بالطعام فقط، فإن استجابته التعزيزية تتدنى تلقائياً عندما يكون الكائن الحي في حالة شبع غذائي تام، ما لم يكن هذا المثير قد ارتبط بحزمة متعددة ومتنوعة من المعززات الأولية كما هو الحال في المعززات الشرطية المعممة.
المحدد الرابع يتضمن التمايز والتعميم المثيري (Stimulus Discrimination and Generalization)؛ حيث يميل الكائن إلى تعميم استجابته التعزيزية للمثيرات المشابهة للمثير الشرطي الأصلي في الخصائص الفيزيائية، كدرجة اللون أو طبقة الصوت. ومع ذلك، فإن التعلم التفريقي والتعرض المنظم للتجارب يجعل الاستجابة تتمركز بدقة حول المثير النوعي الأصلي عبر التمايز الإدراكي الدقيق، مما يمنع إهدار الطاقة السلوكية في استجابات موجهة نحو مثيرات تفتقر إلى العلاقة التعزيزية الحقيقية.
تصنيفات المعززات الشرطية وأنماطها البنيوية
تنقسم المعززات الشرطية في التحليل النفسي السلوكي إلى عدة فئات بنيوية متميزة، تتفاوت في تعقيدها الوظيفي وعمق تأثيرها، ومن أبرز هذه الفئات:
- المعززات الشرطية البسيطة: وهي مثيرات مقترنة بمعزز أولي واحد محدد (مثل صوت جرس ارتبط بتقديم جرعة ماء لحيوان عطش، أو نغمة اقترنت بتقديم قطعة سكر لطفل)، وتعتمد قوتها مباشرة على حالة الدافع المرتبطة بذلك المعزز الأولي المفرد.
- المعززات الشرطية المعممة (Generalized Conditioned Reinforcers): وتعتبر من أقوى أدوات الضبط السلوكي على الإطلاق؛ لأنها مقترنة بعدة معززات أولية وشروط تعزيزية متنوعة في آن واحد. الميزة الجوهرية لهذه الفئة تكمن في عدم اعتمادها على دافع عضوي محدد بمفرده.
- المعززات الاجتماعية: تشمل الإشارات الصادرة من أفراد النوع الواحد كابتسامة التقدير، التواصل البصري الإيجابي، والثناء اللفظي والمكانة المجتمعية، وهي معززات تكتسب فعاليتها عبر التنشئة الاجتماعية المبكرة واقترانها بالأمان والرعاية الجسدية.
- المعززات الرمزية (Token Reinforcers): أشياء مادية محايدة بطبيعتها، كقطع البلاستيك أو النقاط الرقمية أو القسائم، لا قيمة ذاتية لها إطلاقاً ولكن يمكن استبدالها لاحقاً بمعززات أولية أو ثانوية مرغوبة.
يمثل المال النموذج الأبرز والأكثر تطوراً للمعزز الشرطي المعمم في المجتمعات البشرية؛ فورقة النقد بحد ذاتها ليست صالحة للأكل ولا تقي برداً ولا تحمي من خطر، ولكن نظراً لإمكانية استبدالها بجميع أشكال المعززات الأولية (طعام، مأوى، دواء) والمعززات الثانوية (مكانة، ترفيه، استقلال ذاتي)، فإنها تكتسب قوة دفع سلوكية شبه مطلقة تكاد تجعل سلوك السعي وراءها يبدو غريزياً فmodeلاً في ظاهره السطحي.
من الأنماط الهامة أيضاً تطبيق مبدأ بريماك (Premack's Principle)، والذي يفترض أن الأنشطة الأكثر احتمالاً وتفضيلاً لدى الفرد يمكن أن تعمل كمعززات شرطية للأنشطة الأقل احتمالاً وتفضيلاً. في هذا السياق، يتحول نشاط مفضل مثل اللعب في الهواء الطلق أو تصفح الأجهزة اللوحية إلى معزز شرطي نشاطي يدفع المتعلم لإنجاز مهام شاقة مثل حل المسائل الرياضية أو تنظيف الغرفة.
الأسس البيولوجية والعصبية للتعزيز الشرطي
شهدت الأبحاث البيولوجية العصبية طفرة هائلة في العقود الأخيرة بفضل تقنيات التصوير بالرنين المغناطيسي الوظيفي وتسجيل النشاط العصبي المجهري، والتي كشفت النقاب عن الآليات التحتية لكيفية تحول المثير المحايد إلى معزز في الدماغ. يلعب مسار المكافأة الميزوليمبي (Mesolimbic Dopamine Pathway) دوراً رئيسياً في هذا التحول، حيث أظهرت دراسات عالم الأعصاب الشهير ولفرام شولتز (Wolfram Schultz) أن عصبونات الدوبامين في المنطقة السقيفية البطنية (VTA) والنواة المتكئة (Nucleus Accumbens) تطلق نبضاتها في البداية استجابةً للمعزز الأولي غير المتوقع.
مع تكرار الاقتران الشرطي، يحدث تحول عصبي دراماتيكي مدهش؛ إذ تتوقف خلايا الدوبامين تدريجياً عن إطلاق نبضاتها عند تقديم المعزز الأولي ذاته طالما كان متوقعاً، وتبدأ بدلاً من ذلك في إطلاق نبضاتها بكثافة فور ظهور المثير الشرطي التنبؤي المحايد سابقاً. يُعرف هذا الاكتشاف بـ إشارة خطأ التنبؤ بالمكافأة (Reward Prediction Error)، وهو يبرهن عصبياً على أن الدماغ قد قام بنقل القيمة التعزيزية من المكافأة الحقيقية إلى المثير الشرطي الذي يسبقها، ليصبح الأخير بؤرة إفراز الدوبامين والمحرك الفعلي للدافع.
تشارك القشرة الجبهية الحجاجية (Orbitofrontal Cortex – OFC) جنباً إلى جنب مع اللوزة الدماغية (Amygdala) في تقييم القيمة المعرفية التراكمية للمثيرات الشرطية وتحديثها باستمرار وفقاً للسياق الراهن. تُمكن اللوزة الفرد من ترميز الربط الوجداني السريع بين المثير والمشاعر المصاحبة للمكافأة، بينما تقوم القشرة الجبهية بحساب الحسابات الاحتمالية العقلانية حول جدوى الاستجابة للمعزز الشرطي في ظل المتغيرات البيئية الحالية، مما يمنع السلوك من الانزلاق إلى الآلية العمياء غير المتكيفة.
على المستوى الجزيئي والخلوي، يتأسس التعزيز المشروط على آليات اللدونة المشبكية (Synaptic Plasticity) المعروفة بظاهرة التقوية طويلة الأمد (Long-Term Potentiation – LTP) في الحصين ومراكز الذاكرة والتعلم؛ حيث يؤدي التنشيط المتزامن والمتكرر للمسارات العصبية الحركية والحسية إلى إعادة هيكلة المستقبلات الكيميائية العصبية (مثل مستقبلات الغلوتامات NMDA وAMPA)، مما يرسخ الاستجابة المشروطة كمسار عصبي صلب يتطلب جهداً أدنى للتحفيز في المستقبل.
التطبيقات الإكلينيكية والتربوية للتعزيز الشرطي
يمثل اقتصاد الرموز (Token Economy) أحد أشهر التطبيقات الميدانية وأكثرها رسوخاً لمفهوم المعزز الشرطي في البيئات المؤسسية مثل المصحات النفسية، ومراكز علاج الإدمان، والسجون، والمدارس النظامية. يقوم هذا النظام على منح المستفيدين رموزاً مادية (كالبطاقات أو النقاط) كمعززات شرطية فورية للأفعال السلوكية الإيجابية المتوافقة، ليقوم الفرد لاحقاً بتبادلها بمكافآت احتياطية (Back-up Reinforcers) ذات قيمة نفعية لديه كأوقات الترفيه أو المأكولات الخاصة، مما يساعد في ترسيخ أنماط انضباطية يصعب تحقيقها عبر التدخل اللفظي وحده.
في ميدان تحليل السلوك التطبيقي (Applied Behavior Analysis – ABA)، يُعتمد على تقنيات التعزيز الشرطي بصفة حيوية في تعليم وتأهيل الأطفال ذوي اضطراب طيف التوحد (ASD) والإعاقات النمائية؛ حيث يتم إجراء تدريب دقيق يسمى “الاقتران التعزيزي” (Conditioning/Pairing)، يقوم فيه المعالج بربط نفسه والمحيط التعليمي ومثيرات الثناء اللفظي بالمعززات المفضلة للطفل (أطعمة، ألعاب حسية)، ليصبح وجود المعالج وكلمات الثناء بحد ذاتها معززات شرطية تدفع الطفل لاكتساب مهارات لغوية وتواصلية جديدة وسد الفجوات الإنمائية لديه.
على صعيد علم النفس المرضي والإدمان، يكشف المفهوم عن الجانب المظلم للتعزيز الشرطي؛ فالأدوات المرافقة لتعاطي المخدرات (كالإبر، وأماكن التعاطي، ورفقاء السوء) تتحول عبر الاقتران إلى معززات شرطية ومثيرات تحفيزية خارقة قادرة على إثارة الاشتهاء العصبي العارم (Craving) حتى بعد مرور سنوات من الامتناع الفسيولوجي. يركز العلاج السلوكي المعرفي المعاصر على تفكيك هذه الروابط المشروطة عبر التعريض التدريجي ومنع الاستجابة لتحقيق الانطفاء السلوكي لتلك المثيرات المكتسبة.
يمتد التطبيق إلى الاقتصاد السلوكي والتسويق الحديث وعوالم الألعاب الرقمية من خلال استراتيجيات التلعيب (Gamification)؛ حيث تمنح منصات التواصل الاجتماعي والتطبيقات الرقمية مستخدميها إشعارات بصرية وشارات رقمية ورموز إعجاب تمثل معززات شرطية معممة تجعل المستخدمين ينخرطون في استجابات تكرارية مستمرة تقترب من أنماط السلوك الإدماني القهري، مستغلة في ذلك المسار العصبي والارتباط القيمي المكتسب لتلك الرموز التفاعلية.
التحديات والانتقادات النظرية للمفهوم
واجه مفهوم المعزز الشرطي موجة عريضة من الانتقادات المعرفية والإنسانية عبر تاريخ تطوره؛ فقد اعتبر علماء النفس المعرفيون، بدءاً من إدوارد تولمان وأبحاثه حول “التعلم الكامن” (Latent Learning)، أن المدرسة السلوكية تختزل تعقيد الذهن البشري حين تفترض أن المعزز يعمل فقط على تقوية الاستجابة عبر الاقتران الآلي الصامت. أثبتت الدراسات المعرفية أن الكائنات تكوّن “خرائط معرفية” وتفهم العلاقات السببية المنطقية، وأن دافعية الكائن لا تستند إلى الارتباط الميكانيكي بقدر ما تستند إلى القيمة الإدراكية الذاتية للموقف والمعنى المستخلص منه.
من أبرز الانتقادات الوجيهة أيضاً ما طرحه إدوارد ديسي وريتشارد رايان ضمن نظرية تقرير المصير (Self-Determination Theory)؛ حيث كشفا عما يعرف بـ أثر التبرير الزائد (Overjustification Effect). وفقاً لهذه الظاهرة، فإن الإفراط في استخدام المعززات الشرطية الخارجية والرمزية (مثل المكافآت المالية أو النقاط التقييمية) لمكافأة أفعال يقوم بها الفرد بدافع داخلي ذاتي (Intrinsic Motivation) كالقراءة أو الرسم، يؤدي paradoxically إلى تدمير الدافع الداخلي الذاتي للفرد، ليصبح السلوك مرهوناً كلياً بتلقي التعزيز الخارجي المستمر.
يتمثل التحدي العملي الآخر في معضلة الانطفاء التدريجي (Extinction Drift)؛ فالمعزز الشرطي يظل هشاً إذا لم يتم تعزيزه مجدداً بالمعزز الأولي بين الحين والآخر؛ إذ يبدأ السلوك في التلاشي تدريجياً بمجرد إدراك الفرد أن الرمز لم يعد مؤدياً إلى المكافأة الأصلية. يفرض هذا التحدي على المشتغلين في هندسة السلوك والمربين إيجاد توازن دقيق ومستمر يضمن تجديد شحنة المعززات الثانوية دورياً لتجنب فقدانها لفاعليتها الداعمة والموجهة للسلوك.
خاتمة
يظل المعزز الشرطي مفهوماً محورياً وعميق الدلالة في الفكر النفسي المعاصر، يبرهن على القدرة التكيفية الفائقة للكائنات الحية على تطويع المثيرات البيئية المحايدة وتحويلها إلى قوى دافعية ذات معنى وقيمة سلوكية واجتماعية. من خلال تضافر مبادئ الاقتران الإشراطي والتشريح العصبي للدماغ، يفسر هذا المفهوم كيف تنسج العادات الإنسانية المعقدة وكيف تتأسس المنظومات القيمية والاقتصادية التي تقود الحضارات. وعلى الرغم من الملاحظات المعرفية التي تحذر من إغفال الدافعية الذاتية للفرد، فإن الفهم العلمي المنضبط للمعزز الشرطي يظل أداة لا غنى عنها في التعديل السلوكي الإكلينيكي، والارتقاء بالعمليات التعليمية، وتفسير خفايا النشاط العصبي والذهني البشري.
المراجع
- بافلوف، إ. ب. (1927). المنعكسات المشروطة: تحقيق في النشاط الفسيولوجي للقشرة المخية. ترجمة دار الفكر العربي، القاهرة.
- سكينر، ب. ف. (1953). العلم والسلوك البشري. دار النشر الجامعية، بيروت.
- شولتز، و. (1998). التنبؤ بالمكافأة التنبؤية واستجابة عصبونات الدوبامين. مجلة الفيزياء العصبية، 80(1)، 1-27. https://doi.org/10.1152/jn.1998.80.1.1
- ريسكورلا، ر. أ.، وواغنر، أ. ر. (1972). نظرية في الإشراط البافلوفي: تنوعات في فاعلية التعزيز واللاتعزيز. في أ. هـ. بلاك، و ف. ف. بروكابي (محرران)، الإشراط الكلاسيكي 2: الأبحاث والنظرية الحالية (ص 64-99). أبلتون سنشري كروفتس.
- ديسي، إ. ل.، ورايان، ر. م. (2000). “ماذا” و”لماذا” في أهداف السلوك: الحاجات الإنسانية والدافعية الذاتية. الاستفسار النفسي، 11(4)، 227-268. https://doi.org/10.1207/S15327965PLI1104_01
- ميلر، ن. إ. (1948). دراسات في الخوف بوصفه دافعاً قابلاً للاكتساب: التثبيت المشروط للأداء الحركي. مجلة علم النفس التجريبي، 38(1)، 89-101. https://doi.org/10.1037/h0058444
- كازدين، أ. إ. (1977). اقتصاد الرموز: مراجعة شاملة للبحث والممارسة. دار نشر بلينوم، نيويورك.
- بيرس، ج. د.، وتشيني، ج. د. (2017). تحليل السلوك والتعلم: منظور تطبيقي ومعرفي (الطبعة السادسة). روتليدج.