تُعد مقاييس التقدير المرتكزة على السلوك (Behaviorally Anchored Rating Scales)، والمعروفة اختصاراً بـ (BARS)، واحدة من أبرز الابتكارات المنهجية في حقل علم النفس الصناعي والتنظيمي والقياس النفسي المطبق على بيئات العمل. صُممت هذه المقاييس لتجاوز أوجه القصور المزمنة في أدوات تقييم الأداء التقليدية، من خلال ربط الدرجات الرقمية بأمثلة سلوكية واقعية ومحددة تم رصدها تجريبياً. يمثل هذا المدخل نقلة نوعية من التقييم القائم على السمات الشخصية المجردة إلى التقييم القائم على السلوك الموضوعي الملاحظ، مما يمنح عملية القياس رصانة سيكومترية عالية ويعزز العدالة التنظيمية.
السياق التاريخي والنشأة الفكرية
نشأت مقاييس التقدير المرتكزة على السلوك في مطلع ستينيات القرن العشرين نتيجة تزايد الانتقادات الموجهة لمقاييس التقدير البيانية التقليدية (Graphic Rating Scales)، والتي كانت تعتمد على تقدير سمات غامضة مثل “المبادرة”، و”الولاء”، و”الاعتمادية”. لاحظ علماء النفس المهني أن هذه المقاييس تعاني من تدني مستويات الثبات والصدق، وتخضع بشكل فج لتحيزات المقيّمين الشخصية، مما يجعلها غير صالحة لاتخاذ قرارات حاسمة كالترقية أو إنهاء الخدمة. في هذا السياق، قاد العالمان باتريشيا كين كيندال وسميث (Smith & Kendall, 1963) محاولة ثورية لإعادة صياغة أدوات قياس الأداء البشري بناءً على أسس نفسية تجريبية متينة.
استندت فكرة سميث وكيندال إلى دمج منهجية تقنية الحوادث الحرجة (Critical Incident Technique) التي طورها جون فلاناغان في أربعينيات القرن الماضي مع تقنيات القياس المتدرج الكلاسيكية. كان الهدف الجوهري هو إشراك شاغلي الوظائف ومشرفيهم المباشرين في عملية بناء المقياس بدلاً من الاعتماد فقط على تصورات الخبراء النظريين، لضمان تطابق الأوصاف اللغوية للمقياس مع الواقع اليومي للعمل. هذا التحول الديمقراطي والمنهجي أتاح للمنظمات الحصول على إطار تقييم يتحدث بلغة الميدان ويعكس متطلبات الأداء الفعلية بدقة بالغة.
توالت بعد ذلك الدراسات التجريبية خلال عقدي السبعينيات والثمانينيات لاختبار الخصائص السيكومترية لمقاييس التقدير المرتكزة على السلوك مقارنة بالأدوات الأخرى. وقد أسهم علماء بارزون مثل دونالد شواب وبرناردين في تدقيق هذه المنهجية، وتطوير أشكال مشتقة منها للتعامل مع التكاليف المرتفعة والجهد المضني الذي يتطلبه بناؤها، مما رسخ مكانتها كمعيار ذهبي للتقييم الموضوعي في الأدبيات التنظيمية والبحثية.
الأسس النظرية والمفاهيمية للمقياس
يرتكز مقياس (BARS) على فرضية معرفية-سلوكية مفادها أن الأداء الوظيفي ليس سمة كامنة غير مرئية، بل هو سلسلة من الاستجابات السلوكية القابلة للملاحظة والتوثيق والقياس المباشر. تنص النظريات السيكولوجية المرتبطة بمعالجة المعلومات الاجتماعية على أن إصدار الأحكام التقييمية يكون أكثر دقة وأقل عرضة للتشويه المعرفي عندما تتوفر للملاحظ معالم إسناد خارجية واضحة ومحددة. تعمل المراسي السلوكية في هذا المقياس كأطر مرجعية معرفية تقلل العبء الذهني الواقع على المقيّم، وتوجه انتباهه نحو معايير محددة سلفاً بدلاً من الاعتماد على انطباعاته الضمنية.
يستند المقياس أيضاً إلى مبادئ القياس البسيكوفيزيقي والقياس النفسي الكلاسيكي، وتحديداً منهجية ثورستون في التدرج التوافقي؛ حيث يتم تعيين قيم عددية للأوصاف السلوكية بناءً على إجماع الخبراء والممارسين حول مستوى الفعالية الذي يمثله كل سلوك. يضمن هذا النهج توزيع السلوكيات على متصل يمتد من الأداء غير الفعال للغاية إلى الأداء المتميز استثنائياً عبر فترات قياس متساوية نفسياً بقدر الإمكان. يساهم ذلك في تحويل المتغيرات النوعية المعقدة إلى بيانات كمية دقيقة تلبي شروط القياس الفئوي في الإحصاء النفسي.
إلى جانب ذلك، تتشابك هذه المقاييس مع نظرية وضع الأهداف للوك ولاثام ونظريات التعلم الاجتماعي لألبرت باندورا؛ إذ توفر هذه المقاييس للموظفين أمثلة واضحة المعالم عن الأنماط السلوكية المقبولة وتلك التي تستوجب التحسين والتطوير. لا تقتصر وظيفة المقياس على كونه أداة للرصد البعدي، بل يعمل كأداة توجيه قبلي تشكل دافعية الفرد وتعزز كفاءته الذاتية من خلال توضيح نماذج الاقتداء السلوكي المطلوبة داخل المنظومة.
خطوات وإجراءات بناء وتطوير مقياس التقدير المرتكز على السلوك
تعتبر عملية بناء مقياس التقدير المرتكز على السلوك من العمليات المنهجية الشاقة متسلسلة المراحل، والتي تتطلب مشاركة واسعة ومكثفة من أصحاب المصلحة. تتكون العملية عادة من خمس مراحل رئيسية لضمان أعلى درجات الدقة والصدق الإجرائي:
- جمع الحوادث الحرجة: يقوم فريق الباحثين بإجراء مقابلات أو استبانات مع مجموعات من شاغلي الوظيفة والمشرفين (يُطلق عليهم الخبراء المتخصصون SME)، حيث يُطلب منهم وصف مواقف واقعية محددة تمثل أداءً ممتازاً، أو أداءً متوسطاً، أو أداءً ضعيفاً في الوظيفة المستهدفة، مع التركيز على وصف السياق والسلوك والنتيجة بدقة.
- تطوير أبعاد الأداء: تُفرز هذه الحوادث وتُحلل بواسطة لجان بحثية مستقلة لتصنيفها إلى أبعاد أو كفايات رئيسية تعكس بنية العمل (مثل: خدمة العملاء، حل المشكلات، التواصل الفعال، القيادة الفنية).
- إعادة الترجمة والتصنيف المستقل (Retranslation): تُعرض الحوادث الحرجة والأبعاد الناتجة على مجموعة ثانية مستقلة من الخبراء، دون إطلاعهم على التصنيف الأصلي. يُطلب منهم تصنيف كل سلوك في البعد الذي يناسبه؛ وتُستبعد أي حادثة سلوكية لا تحظى بنسبة اتفاق معينة (عادة من 60% إلى 80%) بين المجموعتين لضمان استقرار البنية المفاهيمية.
- تحديد درجات الفعالية السلوكية: يُطلب من الخبراء تقييم مستوى الفعالية لكل سلوك مجاز على مقياس متدرج (من 1 إلى 7 أو من 1 إلى 9 نقاط عادة). تُحسب المتوسطات الحسابية والانحرافات المعيارية لكل عبارة؛ فإذا كان الانحراف المعياري لعبارة ما مرتفعاً، يُشير ذلك إلى خلاف بين المحكمين حول قيمتها وتُحذف فوراً.
- بناء المقياس النهائي وتثبيت المراسي: يُنتقى عدد محدد من العبارات السلوكية ذات الانحراف المعياري المنخفض والمتوسطات المتدرجة بانتظام، لتوضع كـ “مراسي” (Anchors) على طول تدريج التقييم الخاص بكل بعد وظيفي، ليصبح المقياس جاهزاً للاستخدام الميداني.
تضمن هذه العملية الصارمة خلو الأداة من التخمين الشخصي، وترفع من موثوقية الأداة عبر ترسيخ أسس علمية قابلة للتكرار والتحقق، وتجعل أبعاد المقياس متجذرة في تحليل مهني دقيق للوظيفة.
المزايا السيكومترية والتطبيقية لمقاييس BARS
تحقق مقاييس التقدير المرتكزة على السلوك قيمة مضافة هائلة للمنظمات والباحثين مقارنة بالبدائل المتاحة، نظراً لخصائصها السيكومترية الرفيعة وقبولها النفسي الواسع. من أهم هذه المزايا تحسين ثبات المقيمين الداخلي (Inter-rater Reliability)؛ فعندما يطالع مقيّمان مختلفان الموظف نفسه، فإن وجود أمثلة سلوكية دقيقة يقلل من تباين التفسيرات بينهما، مما يقود إلى درجات متسقة بدرجة عالية مقارنة بالمقاييس الانطباعية.
تسهم هذه المقاييس في تقليل الأخطاء الإدراكية الشهيرة مثل خطأ التساهل (Leniency Error) وخطأ النزعة المركزية (Central Tendency). بما أن كل درجة رقمية مشروطة بوجود نمط سلوكي محدد، يصعب على المشرف منح درجات عشوائية مرتفعة للموظف غير الكفء أو اللجوء للدرجة الوسطى لتجنب الحرج، إذ يُلزم المقيّم بتقديم شواهد سلوكية تطابق المرساة المعتمدة لكل درجة.
تتميز مقاييس BARS بصدق محتوى وظاهري مرتفع للغاية؛ فالموظفون يثقون في الأداة لأنها تشير إلى تفاصيل عملهم الحقيقية وليست مجرد أحكام تجريدية. يسهل هذا الصدق الملموس تقديم تغذية راجعة constructive feedback أثناء جلسات التقييم الدوري، حيث يمكن للمشرف تحديد السلوكيات التي مارسها الموظف، ومقارنتها بالسلوكيات المطلوبة للارتقاء إلى المستوى الأعلى، مما يحول جلسة التقييم من مواجهة دفاعية إلى خطة تنموية محددة المسار.
التحديات والانتقادات السيكومترية
على الرغم من الرصانة المنهجية التي تتمتع بها مقاييس التقدير المرتكزة على السلوك، إلا أنها لم تكن بمنأى عن الانتقادات العلمية والتنظيمية. العقبة الأولى والأكثر إلحاحاً هي التكلفة الباهظة والوقت الطويل المستغرق في تطويرها؛ إذ يتطلب كل مسمى وظيفي تصميماً مخصصاً وإجراءات حوادث حرجة مستقلة، مما يجعل تطبيقها في المنظمات الكبيرة التي تضم مئات التوصيفات الوظيفية المتنوعة أمراً شاقاً ومكلفاً جداً من الناحية اللوجستية والمالية.
تتمثل المشكلة السيكولوجية الأخرى في ما يُعرف بـ “معضلة غياب السلوك المماثل”؛ فغالباً ما يواجه المقيّم أثناء التقييم الفعلي سلوكاً من الموظف لا يطابق تماماً السلوك المذكور في المرساة، وإنما يشبهه جزئياً أو يقع في منطقة رمادية غير مذكورة. يضع هذا الموقف المقيّم في حيرة معرفية، ويضطره إلى التخمين أو الاستقراء الذاتي، مما قد يعيد إدخال التحيز من الباب الخلفي للأداة القياسية.
أشارت بعض الدراسات المرجعية الكبرى، مثل مراجعات كاسيو وأغوينيس، إلى أن التفوق الإحصائي لمقاييس BARS على مقاييس التقدير البيانية البسيطة ليس كبيراً دائماً في الممارسة الميدانية إذا كان المقيّمون قد تلقوا تدريباً متقدماً على التقييم. يعني ذلك أن جودة التقييم ترتبط أيضاً بالعمليات المعرفية وتدريب المقيّمين، وليس بهيكل المقياس وحده.
المقارنة مع مقاييس التقييم المعاصرة
لفهم موقع BARS في ترسانة أدوات القياس النفسي الوظيفي، يجب مقارنتها بنظائرها المباشرة؛ وأبرزها مقاييس الملاحظة السلوكية (Behavioral Observation Scales – BOS) التي طورها لاثام ووكسلي. في حين تركز BARS على تقييم مستوى الكفاءة المتوقع من خلال ربط الموظف بنقطة سلوكية مرجعية، تطلب مقاييس BOS من المقيّم رصد تكرار حدوث سلوكيات محددة على مقياس تكراري ليكرت (مثلاً: نادراً، أحياناً، دائماً). يجعل هذا التمييز BOS أكثر اعتماداً على الذاكرة الكمية، بينما تعتمد BARS على المطابقة المعرفية الشاملة للنمط السلوكي.
أما بالمقارنة مع مقاييس التقدير التوقعية السلوكية (Behavioral Expectation Scales – BES)، فإن الخط الفاصل بينهما دقيق تاريخياً؛ إذ تركز BES على التنبؤ بما يمكن للموظف أن يفعله في ظل ظروف معينة (Expectation)، بينما تحولت صيغ BARS الحديثة نحو تقييم ما تم إنجازه أو السلوك الملاحظ الفعلي. كما تتفوق BARS على المقاييس المعيارية الترتيبية (Rankings) ومقاييس التوزيع الإجباري (Forced Distribution)، لأنها تقيس الأداء الفردي استناداً إلى معيار مطلق للسلوك المطلوب، وليس بمقارنة الموظفين ببعضهم البعض، مما يحافظ على مناخ التعاون المؤسسي ويحد من التنافس الضار.
توضح هذه المقارنات أن BARS تمثل حلاً وسطاً نموذجياً يجمع بين القياس الموضوعي للحقائق السلوكية والتقييم النوعي لمستويات الفعالية المهنية، متفادية عيوب المقاييس الرقمية البحتة والانطباعية الذاتية في آن واحد.
تحيزات المقيّمين واستراتيجيات الضبط
على الرغم من صلابة مراسي السلوك، تظل الذاتية البشرية مصدراً لتشويه نتائج القياس ما لم تُضبط بإجراءات صارمة. من أبرز هذه التحيزات تأثير الهالة (Halo Effect)، حيث يسمح المشرف لانطباعه العام الإيجابي أو السلبي عن الموظف بأن يلون تقييمه لجميع الأبعاد السلوكية المحددة، متجاهلاً الفروق الفردية الواضحة بين كفايات الموظف في الجوانب المختلفة.
يبرز أيضاً تحيز الحداثة (Recency Bias)، حيث يميل المقيّمون إلى التركيز على الحوادث السلوكية التي وقعت في الأسابيع القليلة السابقة لموعد التقييم، وتجاهل أداء الموظف خلال الأشهر الطويلة المنصرمة من دورة التقييم. للتغلب على هذه المشكلات المعرفية، تقترح أدبيات الإدارة والقياس النفسي الاعتماد على دفاتر الملاحظات السلوكية الدورية أو السجلات الرقمية للأداء، حيث يُدوّن المشرف الحوادث السلوكية بانتظام بمجرد وقوعها، لتكون مرجعاً موثوقاً عند إسقاط السلوكيات على مقياس BARS السنوي.
كما يُعد تطبيق برامج التدريب على الإطار المرجعي (Frame-of-Reference Training – FORT) من أكثر الأدوات فعالية لضبط هذه التحيزات؛ إذ يتم تدريب المشرفين عبر أمثلة فيديو ومحاكاة عملية على كيفية تفسير الأبعاد السلوكية والمراسي المتصلة بها وفق رؤية المنظمة الموحدة. يؤدي هذا التوافق المفاهيمي إلى تفكيك التحيزات المعرفية ورفع ثبات التقديرات التقييمية إلى مستوياتها المثلى.
التطبيقات الحديثة في العصر الرقمي والذكاء الاصطناعي
مع تسارع وتيرة التحول الرقمي وتغير بيئات العمل نحو النماذج الهجينة والمرنة، تشهد مقاييس التقدير المرتكزة على السلوك تحولات وتطبيقات غير مسبوقة. لم تعد الحوادث الحرجة تُجمع فقط عبر استبانات ورقية ومقابلات مطولة؛ بل بات بالإمكان استخلاصها وتحليلها باستخدام تقنيات التنقيب في النصوص واستخراج البيانات من برمجيات إدارة المشاريع ومنصات التواصل المؤسسي، مع الحفاظ التام على خصوصية العاملين وسرية بياناتهم.
بدأت منظمات متقدمة في دمج خوارزميات تعلم الآلة ومعالجة اللغات الطبيعية (NLP) لمطابقة المخرجات السلوكية الرقمية للموظفين بالمراسي الخاصة بمقاييس BARS تلقائياً. يوفر ذلك دعماً معرفياً مستمراً للمشرف أثناء مرحلة التقييم ويقلل من وقت معالجة البيانات، مما يسمح بالانتقال من التقييم السنوي المتقطع إلى ما يُعرف بـ “التغذية الراجعة السلوكية في الوقت الفعلي” (Real-Time Behavioral Feedback).
علاوة على ذلك، أصبحت مقاييس BARS أداة مركزية في تصميم خوارزميات الذكاء الاصطناعي المسؤولة عن التدقيق ومحاكاة مهارات المقابلات الشخصية الافتراضية واختبارات الحكم الظرفي (Situational Judgment Tests – SJT). يتم استخدام المراسي السلوكية لتدريب النماذج اللغوية على فهم ما يشكل استجابة احترافية رفيعة في الأزمات وما يعتبر سلوكاً غير مقبول، مما يوسع نطاق تطبيق BARS من مجرد أداة لإدارة الأداء إلى حجر زاوية في منظومات التوظيف والتدريب والقياس المعتمدة على الذكاء الاصطناعي.
خاتمة
تظل مقاييس التقدير المرتكزة على السلوك (BARS) نموذجاً ساطعاً للنجاح عندما تلتقي الدقة المنهجية في علم النفس التطبيقي باحتياجات الواقع العملي في المنظمات. فرغم متطلبات بنائها المعقدة واستنزافها للموارد في المراحل الأولى، فإنها تقدم حلاً جذرياً لمشكلة غياب العدالة والموضوعية التي طالما شابت تقييم الأداء البشري، من خلال ربط القياس بالواقع الميداني والتركيز على السلوك دون الشخصنة. وفي ظل التحولات التكنولوجية المعاصرة وتصاعد الاعتماد على النظم الرقمية، تثبت مقاييس BARS مرونتها وقدرتها على البقاء، مؤكدة أن تقييم السلوك الإنساني بدقة يظل الركيزة الأساسية لأي تطوير تنظيمي ناجح ومستدام.
المراجع
- Bernardin, H. J., & Smith, P. C. (1981). A clarification of some issues regarding the development and use of behaviorally anchored rating scales (BARS). Journal of Applied Psychology, 66(4), 458–463. https://doi.org/10.1037/0021-9010.66.4.458
- Cascio, W. F., & Aguinis, H. (2019). Applied psychology in talent management (8th ed.). SAGE Publications.
- Flanagan, J. C. (1954). The critical incident technique. Psychological Bulletin, 51(4), 327–358. https://doi.org/10.1037/h0061470
- Latham, G. P., & Wexley, K. N. (1977). Behavioral observation scales for performance appraisal purposes. Personnel Psychology, 30(2), 255–268. https://doi.org/10.1111/j.1744-6570.1977.tb02092.x
- Schwab, D. P., Heneman, H. G., & DeCotiis, T. A. (1975). Behaviorally anchored rating scales: A review of theory, practice, and research. Personnel Psychology, 28(4), 549–562. https://doi.org/10.1111/j.1744-6570.1975.tb01392.x
- Smith, P. C., & Kendall, L. M. (1963). Retranslation of expectations: An approach to the construction of unambiguous anchors for ratings of psychometric devices. Journal of Applied Psychology, 47(2), 149–155. https://doi.org/10.1037/h0047060