يمثل المعزز الشرطي (Conditioned Reinforcer)، والذي يُعرف في الأدبيات النفسية بالمعزز الثانوي، إحدى الركائز الأساسية التي يقوم عليها فهمنا لكيفية اكتساب الكائنات الحية للأنماط السلوكية المعقدة وتطويرها واستمرارها عبر الزمن. لا يولد الإنسان ولديه استجابة فطرية مسبقة لقيمة النقود، أو الشهادات الأكاديمية، أو الإيماءات الاجتماعية المشجعة؛ ومع ذلك، تحرك هذه المثيرات أعتى دوافع السلوك البشري وتوجه مسارات الحياة اليومية. يكشف التحليل العلمي الدقيق لهذه الظاهرة عن قدرة الدماغ البشري المذهلة على ربط الأحداث البيئية المحايدة بحاجات البقاء الأساسية، مما يمنح المثيرات العادية سلطة تحفيزية فائقة تُعيد هندسة المنظومة النفسية والسلوكية للفرد بصورة جذرية.
المفهوم والتعريف الاصطلاحي للمعزز الشرطي
يُعرَّف المعزز الشرطي في سياق علم النفس السلوكي بأنه أي مثير بيئي محايد في الأصل يكتسب قدرته على زيادة احتمالية تكرار الاستجابة السلوكية التي تعقبه، وذلك نتيجة اقترانه المتكرر والمنظم بمثير آخر يمتلك بالفعل خاصية التعزيز، سواء كان هذا الأخير معززاً أولياً فطرياً أو معززاً شرطياً راسخاً من قبل. إن جوهر هذه العملية يكمن في التحول الوظيفي للمثير؛ حيث يتحول من مجرد إشارة حسية لا تثير دافعاً بذاتها إلى قوة موجهة ودافعة للسلوك، قادرة على المحافظة على استمرارية الأداء لفترات طويلة حتى في غياب الإشباع العضوي المباشر.
يستند هذا التعريف إلى التمييز الصارم الذي وضعه رواد التحليل التجريبي للسلوك بين فئتين رئيسيتين من المحفزات البيئية: المعززات غير الشرطية (الأولية) والمعززات الشرطية (الثانوية). فبينما تستمد المعززات الأولية قيمتها من البنية البيولوجية التطورية للكائن الحي لتلبية احتياجات البقاء الملحة مثل الغذاء والماء وتجنب الألم، تنبع قوة المعزز الشرطي بالكامل من تاريخ التعلم الفردي والخبرة التراكمية، مما يجعله مفهوماً مرناً ودينامياً يعكس التفاعل المستمر بين الكائن الحي وبيئته المحيطة عبر مراحل نموه المتتابعة.
من الناحية المعرفية والسلوكية المعاصرة، لا يُنظر إلى المعزز الشرطي اليوم بوصفه مجرد رابط آلي صلب بين مثيرين، بل كبنية معلوماتية توفر للكائن الحي قدرة تنبؤية فائقة حول احتمالية وقوع أحداث بيئية ذات مغزى حيوي. هذا البعد التنبؤي هو ما يمنح المعزز الشرطي مرونته؛ إذ يعتمد استمراره وقوته على دقة المعلومة التي ينقلها بخصوص توفر المعززات اللاحقة، مما يجعله جسراً معرفياً يربط بين الأداء الحاضر والمكافأة المستقبلية، ويشكل أساساً لما نسميه في علم النفس بتأجيل الإشباع والتوجه نحو الأهداف البعيدة المدى.
الجذور النظرية والتطور التاريخي للمفهوم
تعود الإرهاصات الأولى لفهم التعزيز الشرطي إلى التجارب الرائدة التي أجراها عالم الفسيولوجيا الروسي إيفان بافلوف في مطلع القرن العشرين حول الإشراط الاستجابي أو الكلاسيكي. عندما لاحظ بافلوف أن الكلاب تبدأ في إفراز اللعاب ليس فقط عند وضع مسحوق اللحم في أفواهها، بل بمجرد رؤية حارس المختبر أو سماع صوت دقات بندول الإيقاع، كان يضع حجر الأساس لما أطلق عليه لاحقاً “الإشراط من الدرجة الثانية”. بيّنت هذه الملاحظات التجريبية أن المثيرات المحايدة قادرة على اكتساب خصائص مثيرات بيولوجية فطرية إذا ما ارتبطت بها زمنياً ومكانياً وفق مبدأ الاقتران الشرطي المنظم.
ومع صعود المدرسة السلوكية الإجرائية على يد بورهوس فريدريك سكينر في ثلاثينيات وأربعينيات القرن العشرين، انتقل التركيز من مجرد دراسة الأفعال المنعكسة اللاإرادية إلى استكشاف السلوك الإجرائي الفاعل الذي يؤثر في البيئة وينتج عواقب محددة. أعاد سكينر صياغة مفهوم المعزز الشرطي ليصف كيف يمكن لمثير بيئي مقترن بالتعزيز أن يعمل كحافز يعزز الاستجابات الإجرائية الإرادية. في كتابه التأسيسي “سلوك الكائنات الحية” (1938)، أثبت سكينر تجريبياً أن صوت آلة تقديم الطعام في صندوق التجارب يكتسب قيمة تعزيزية مستقلة، تجعل الحيوان مستعداً للضغط على الرافعة لمجرد سماع هذا الصوت حتى لو تأخر تقديم الطعام الفعلي.
شهدت العقود اللاحقة تعميقاً نظرياً وتجريبياً لهذا المفهوم بفضل إسهامات باحثين بارزين مثل كلارك هال، الذي دمج التعزيز الثانوي في نظريته الخاصة باختزال الحافز، وبيتر كليهر، الذي أجرى تجارب مفصلة في الستينيات أظهرت أن سلاسل السلوك المعقدة يمكن الحفاظ عليها لفترات زمنية طويلة جداً باستخدام المعززات الشرطية وحدها ضمن جداول تعزيز معقدة. هذه التطورات رسخت فكرة أن معظم النشاط البشري الراشد لا تدفعه المعززات الأولية بصورة مباشرة، بل تحركه شبكات هائلة من المعززات الشرطية المتشابكة التي تم نسجها عبر سنوات من التنشئة الاجتماعية والتعليم.
آليات التشكيل: كيف يكتسب المثير المحايد خصائصه التعزيزية؟
تتم عملية تحول المثير المحايد إلى معزز شرطي عبر آليات تعلم دقيقة تتطلب شروطاً محددة لضمان الفاعلية والاستقرار. تتلخص الآلية الأولى في الاقتران الفوري والمتكرر (Temporal Contiguity)؛ حيث يجب أن يظهر المثير المحايد في تقارب زمني وثيق يسبق ظهور المعزز الأولي أو يتزامن معه. يؤدي هذا التكرار المتواصل إلى خلق ترابط عصبي وسلوكي متين، يجعل الجهاز العصبي يستجيب للمثير المحايد بالطريقة ذاتها التي يستجيب بها للمثير المعزز الأصلي، مستبقاً إياه ومستعداً له بكفاءة عالية.
ومع ذلك، أثبتت الدراسات المعرفية السلوكية أن الاقتران الزمني وحده لا يكفي؛ بل لا بد من توفر شرط الاحتمالية والاعتمادية التنبؤية (Contingency). وكما أوضح عالم النفس روبرت ريسكورلا في أبحاثه الرائدة، فإن المثير المحايد يكتسب خصائص تعزيزية حقيقية فقط إذا كان يقدم معلومة موثوقة تنبئ بحدوث المعزز التالي بنسبة احتمالية تفوق احتمالية حدوثه في غياب ذلك المثير. إذا كان المثير يظهر عشوائياً دون ارتباط دقيق بالعواقب، فإنه يفشل في اكتساب أي قيمة تعزيزية، مما يؤكد أن التعلم الشرطي ينطوي على معالجة ذكية للعلاقات السببية بين المثيرات البيئية.
تمتد هذه الآلية لتشمل ما يُعرف بـ الإشراط الأعلى رتبة (Higher-Order Conditioning)؛ حيث لا يقتصر اكتساب القيمة التعزيزية على الاقتران بالمعززات الأولية الفطرية فحسب، بل يمكن لمثير محايد جديد أن يكتسب خصائص المعزز إذا اقترن بمعزز شرطي سابق اكتسب قوته في مرحلة تعلم سابقة. هذا التسلسل الهرمي يفسر التعقيد الهائل في الدوافع البشرية؛ فالطفل يتعلم أولاً ربط صوت الأم بالطعام والراحة الجسدية (معزز شرطي من الدرجة الأولى)، ثم يتعلم ربط الكلمات التشجيعية بنبرة الصوت الدافئة (معزز من الدرجة الثانية)، ولاحقاً يربط الدرجات المدرسية العالية بالثناء اللفظي (معزز من الدرجة الثالثة)، مشكلاً بناءً دافعياً متعدد الطبقات.
التمايز المنهجي بين المعززات الأولية والمعززات الشرطية
لفهم الآليات السلوكية بدقة، وضع علماء النفس معايير فارقة تفصل بين المعززات الأولية والمعززات الشرطية على عدة مستويات وظيفية وبيولوجية وتجريبية. يستند هذا التمايز إلى فحص مصدر القوة الدافعية لكل منهما، ومستوى ثباتها، وقابليتها للإنطفاء، وكيفية تأثرها بحالات الحرمان والإشباع العضوي الراهنة في الكائن الحي.
- الأصل البيولوجي مقابل الخبرة المكتسبة: تنشأ المعززات الأولية من التكوين البيولوجي الوراثي دون الحاجة إلى أي خبرة سابقة، كالحاجة إلى التغذية، والحرارة المناسبة، والراحة، والأكسجين. في المقابل، تُعد المعززات الشرطية نتاجاً خالصاً لعملية التعلم والتفاعل البيئي، وتختلف جذرياً من فرد إلى آخر بناءً على السياق الثقافي والخبرات الحياتية الشخصية الفريدة.
- التأثر بحالات الإشباع والحرمان: تفقد المعززات الأولية فاعليتها بصورة سريعة وحادة بمجرد وصول الكائن الحي إلى مرحلة الإشباع الفسيولوجي؛ فالطعام يفقد قيمته التعزيزية تماماً لدى كائن متخم بالطعام. أما المعززات الشرطية، وخاصة المعممة منها، فتتميز بمقاومة أعلى لظاهرة الإشباع المؤقت، إذ تظل قادرة على تحفيز السلوك حتى لو كانت الدوافع البيولوجية المباشرة في حالة استقرار نسبي.
- مقاومة الانطفاء والاستقرار الزمني: لا يمكن للمثير الأولي أن يفقد قيمته التعزيزية الطبيعية إلا بحدوث تغيرات فسيولوجية باثولوجية عميقة، بينما يخضع المعزز الشرطي لقانون الانطفاء السلوكي (Extinction)؛ فإذا استمر ظهور المعزز الشرطي لمرات عديدة دون أن يتبعه المعزز الأصلي الداعم له، فإنه يبدأ تدريجياً في فقدان خصائصه التحفيزية حتى يرجع مجرد مثير محايد كما كان في البداية.
- المرونة والتنوع السلوكي: تتسم المعززات الأولية بمحدودية تنوعها المرتبط بالقوائم البيولوجية المحدودة للأنواع الحية، في حين تظهر المعززات الشرطية قدرة لا نهائية على التنوع والابتكار، مما يسمح للأنظمة الاجتماعية بصياغة رموز وقيم ومراتب اعتبارية تعمل كمعززات فائقة القوة تُصمم خصيصاً لتوجيه السلوك الجمعي.
المعززات الشرطية المعممة وقوتها السلوكية الفائقة
تحتل المعززات الشرطية المعممة (Generalized Conditioned Reinforcers) مكانة استثنائية في التحليل النفسي السلوكي؛ نظراً لخصائصها الفريدة التي تجعلها تتفوق أحياناً في تأثيرها على المعززات الأولية ذاتها. يُعرف المعزز المعمم بأنه مثير شرطي اقترن عبر تاريخ التعلم بالعديد من المعززات الأولية والشرطية المختلفة، بدلاً من اقتصار اقترانه بمعزز وحيد محدد. هذا الارتباط المتشعب يحرره من الاعتماد على أي حالة حرمان فسيولوجية مفردة، ويمنحه ثباتاً دافعياً مستمراً نادراً ما يتزعزع في الحياة اليومية.
يمثل المال النموذج الأكثر وضوحاً وشمولاً للمعزز الشرطي المعمم في المجتمعات البشرية المتحضرة. لا يحمل الورق النقدي أو الرصيد الرقمي في الحسابات البنكية أي قيمة عضوية ذاتية تروي عطشاً أو تسد جوعاً؛ بيد أن اقترانه بالقدرة على شراء الطعام، والدواء، والمسكن، والترفيه، واكتساب المنزلة الاجتماعية الرفيعة، يجعله معززاً مطلق القوة ومستمراً في تأثيره. لا يتعرض الدافع نحو جمع المال للإشباع السريع كما يحدث مع الطعام؛ لأن المال يظل دائماً قابلاً للتحويل إلى عدد لا نهائي من الإشباعات البديلة، مما يجعله محركاً سلوكياً لا ينضب عبر مسار العمر بأكمله.
إلى جانب المال، تبرز المعززات المعممة ذات الطابع الاجتماعي مثل المديح، والانتباه، والتقدير الاجتماعي، والنفوذ كقوى موجهة للسلوك الإنساني. إن الانتباه الاجتماعي الإيجابي يكتسب صفة التعزيز المعمم في مرحلة الطفولة المبكرة؛ حيث يرتبط حضور الراعي واهتمامه بحصول الطفل على التغذية، والحماية، والدفء، والتفاعل العاطفي. ونتيجة لذلك، يظل البحث عن الانتباه والتقدير محركاً مركزياً لسلوك الأفراد في المدارس، والمؤسسات المهنية، وحتى عبر المنصات الرقمية ووسائل التواصل الاجتماعي المعاصرة عبر تفاعلات “الإعجاب” والمشاركات التقديرية.
التطبيقات الإكلينيكية والتربوية: اقتصاد الرموز وتعديل السلوك
لم يظل مفهوم المعزز الشرطي حبيس المختبرات السلوكية الضيقة؛ بل تحول إلى ركيزة تطبيقية أحدثت ثورة حقيقية في مجالات العلاج النفسي والتربية الخاصة والصحة النفسية، ولا سيما من خلال تقنية اقتصاد الرموز (Token Economy). ابتكر هذه التقنية الباحثان أيلون وأزرين في ستينيات القرن الماضي داخل المصحات النفسية، وتقوم على منح الأفراد رموزاً محايدة (مثل قطع بلاستيكية، أو طوابع، أو نقاط رقمية) فور صدور سلوك تكيفي مستهدف، بحيث يمكن للمستفيد لاحقاً استبدال هذه الرموز بقائمة متنوعة من المعززات الداعمة كالأنشطة المفضلة أو المكافآت العينية.
أثبتت هذه التقنية فاعلية منقطعة النظير في العمل مع الأطفال ذوي اضطراب طيف التوحد ومتلازمات النمو العصبي ضمن برامج تحليل السلوك التطبيقي (ABA). يتيح المعزز الشرطي للمعالج أو المعلم تقديم مكافأة فورية في اللحظة الزمنية الدقيقة التي يصدر فيها السلوك المرغوب دون مقاطعة تدفق النشاط التعليمي، ودون تعريض الطفل لإشباع حسي سريع يفقده الرغبة في مواصلة التفاعل. كما أنه يمهد لتدريب الطفل تدريجياً على التحول من المكافآت المادية الفجة إلى المعززات الاجتماعية الأكثر طبيعية وملاءمة للاندماج في البيئة المدرسية والمجتمعية العامة.
في البيئات المدرسية العادية والإصلاحيات التأهيلية، يُستخدم التعزيز الشرطي المنظم لإدارة الفصول الدراسية وتقليل الاضطرابات السلوكية وتدعيم عادات الاستذكار والمسؤولية الذاتية. إن تحويل المهام الصعبة أو البغيضة إلى خطوات صغيرة معززة باستمرار ببطاقات إنجاز أو تقييمات إيجابية دورية يخفف من وطأة القلق المرتبط بالإخفاق، ويزيد من إحساس الفرد بالكفاءة الذاتية، مبرهناً على أن المعززات الشرطية أداة قوية ليس فقط للتحكم في السلوك، بل ولتمكين الأفراد وتطوير مهاراتهم التنظيمية والتنفيذية المستدامة.
العوامل المحددة لفاعلية المعزز الشرطي واستقراره
لا تتسم المعززات الشرطية بفاعلية ثابتة ومطلقة، بل تتأرجح قوتها تبعاً لمصفوفة معقدة من المتغيرات البيئية والتجريبية التي تحكم جودة الرابط الشرطي ومتانته. تتطلب الممارسة السلوكية الرصينة فهماً عميقاً لهذه العوامل لضمان عدم تلاشي التأثير التعزيزي بمرور الوقت وتحقيق أعلى كفاءة تدريبية ممكنة:
- قوة وتنوع المعززات الداعمة الأصيلة: تتناسب فاعلية المعزز الشرطي طردياً مع قوة المعزز الأولي أو الثانوي الذي ارتبط به أصلاً. إذا كان المعزز الداعم ضعيف التأثير أو غير مرغوب فيه بدرجة كافية من قبل المتعلم، فإن المثير المرتبط به سيفشل حتماً في التحول إلى معزز شرطي فعال ومؤثر.
- تكرار التعزيز الاحتياطي المتقطع: لكي يحافظ المعزز الشرطي على قوته ويصمد أمام الانطفاء، يجب ألا يُترك بمفرده بشكل دائم؛ بل يتعين إعادة ربطه دورياً بالمعزز الأصلي الداعم. يضمن هذا الإجراء، الذي يشار إليه غالباً بإعادة الشحن التعزيزي، بقاء القيمة التنبؤية للمثير حية في الذاكرة الوظيفية للجهاز العصبي.
- طول الفاصل الزمني للتأخير: كلما كانت المسافة الزمنية بين تقديم المعزز الشرطي وحصول الفرد على المعزز الداعم النهائي قصيرة ومنتظمة في المراحل الأولى للتدريب، كان اكتساب الخاصية التعزيزية أسرع وأثبت. الفجوات الزمنية المفرطة تؤدي إلى تشوش الترابط السلوكي وضعف التنبؤ، مما يقلل من جاذبية المثير الشرطي.
- حالة العمليات المحفزة والدافعية الراهنة (Motivating Operations): تؤثر الظروف البيئية والجسدية اللحظية للمتعلم على قيمة المعزز الداعم، وبالتالي تنعكس مباشرة على المعزز الشرطي المرتبط به. فحتى لو كان المعزز الشرطي ممتاز التصميم، فإن قيمته الوظيفية تنهار لحظياً إذا كان الفرد في حالة عدم اكتراث تام بالنتيجة النهائية المرتبطة به.
الرؤى العصبية والمعرفية المعاصرة للتعزيز الشرطي
شهدت العقود الأخيرة تقاطعاً مثمراً بين علم النفس السلوكي وعلم الأعصاب الإدراكي، كشف عن الأسس البيولوجية العميقة التي تفسر كيف يتعامل الدماغ مع المعززات الشرطية. أظهرت أبحاث التصوير العصبي الوظيفي وتسجيلات الخلايا العصبية المفردة أن المسار الدوباميني في الدماغ المتوسط (Mesolimbic Dopamine Pathway)، وبشكل خاص الإسقاطات العصبية المتجهة نحو النواة المتكئة (Nucleus Accumbens) والقشرة الجبهية الحجاجية (Orbitofrontal Cortex)، يلعب دوراً محورياً وحاسماً في تشفير القيمة التنبؤية للمعززات الشرطية.
بيّنت تجارب العالم فولفرام شولتز وزملائه حول خطأ التنبؤ بالمكافأة (Reward Prediction Error) أنه عند بداية التدريب، تطلق خلايا الدوبامين دفقاتها العصبية المكثفة عند تقديم المعزز الأولي الفعلي (كالطعام أو العصير). لكن بمجرد أن يستقر الاقتران الشرطي ويتعلم الكائن الحي أن هناك مثيراً محايداً (صوتاً أو ضوءاً) يسبق وصول هذه المكافأة، ينزاح هذا النشاط الدوباميني زمنياً بصورة مذهلة ليحدث لحظة ظهور المثير الشرطي ذاته، متوقفاً عن الانطلاق عند حدوث المكافأة الفعلية المتوقعة. يُعد هذا الاكتشاف برهاناً عصبياً قاطعاً على أن المثير الشرطي لم يعد مجرد إشارة إدراكية هامشية، بل تحول فيزيولوجياً إلى بديل مكافئ للمكافأة، قادر على إثارة حالات التحفيز والترقب العاطفي بكفاءة بالغة.
تتكامل هذه المكتشفات العصبية مع نظرية الدافعية البارزة (Incentive Salience) التي طورها كينت بيريدج، والتي تفرق بصورة قاطعة بين عمليتي “الإعجاب بالشيء والاستمتاع به” (Liking) الناتجة عن المعزز الأولي، و”الرغبة فيه والسعي نحوه” (Wanting) التي يثيرها المعزز الشرطي بصورة طاغية. توضح هذه النظرية كيف يمكن للمعززات الشرطية، كما نرى بوضوح في حالات الإدمان والاضطرابات السلوكية القهرية، أن تحفز السعي المحموم نحو المثيرات المحايدة سابقاً (مثل رؤية أدوات التعاطي أو شاشات القمار) عبر إثارة شبكات الدوبامين الرغائبية، حتى لو لم تعد النتيجة النهائية تحقق أي لذة أو نفع حقيقي للفرد، مسلطة الضوء على الأبعاد المعقدة والخطيرة أحياناً لقوة التعزيز الشرطي في النفس البشرية.
في المحصلة الختامية، يتبين أن المعزز الشرطي ليس مجرد مفهوم فني مقصور على تجارب الفئران والحمام في مختبرات علم النفس، بل هو المحرك الجوهري المنظم للحضارة الإنسانية ونسيج العلاقات الاجتماعية اليومية. فمن خلال قدرته المدهشة على تحويل الإشارات المحايدة إلى بواعث دافعية وموجهات سلوكية راسخة، يمكننا فهم كيف يبني الإنسان آماله وأهدافه المعقدة، وكيف يتمكن من مواصلة الجهد الشاق لسنوات متواصلة سعياً وراء رموز النجاح والتميز التي تستمد طاقتها كلها من هذا القانون السلوكي الخالد.
المراجع
- Pavlov, I. P. (1927). Conditioned reflexes: An investigation of the physiological activity of the cerebral cortex (G. V. Anrep, Trans.). Oxford University Press.
- Skinner, B. F. (1938). The behavior of organisms: An experimental analysis. Appleton-Century-Crofts.
- Skinner, B. F. (1953). Science and human behavior. Macmillan.
- Hull, C. L. (1943). Principles of behavior: An introduction to behavior theory. Appleton-Century-Crofts.
- Kelleher, R. T., & Gollub, L. R. (1962). A review of positive conditioned reinforcement. Journal of the Experimental Analysis of Behavior, 5(4), 543–597.
- Ayllon, T., & Azrin, N. H. (1968). The token economy: A motivational system for therapy and rehabilitation. Appleton-Century-Crofts.
- Schultz, W., Dayan, P., & Montague, P. R. (1997). A neural substrate of prediction and reward. Science, 275(5306), 1593–1599.
- Berridge, K. C., & Robinson, T. E. (2003). Parsing reward: The intrinsic dynamics of liking, wanting, and learning. Current Opinion in Pharmacology, 3(1), 60–66.
- Rescorla, R. A. (1988). Pavlovian conditioning: It’s not what you think it is. American Psychologist, 43(3), 151–160.
- Cooper, J. O., Heron, T. E., & Heward, W. L. (2020). Applied behavior analysis (3rd ed.). Pearson.