رفتن به محتوای اصلی
Koohestun
پژوهش کوهستانعلم استخدامتحلیل هزینه-فایده· 6 دقیقه مطالعه· در کسب‌وکار

ضریب اعتبار ۰/۵۱: آزمون‌های توانایی ذهنی عمومی چگونه عملکرد شغلی را پیش‌بینی می‌کنند

آزمون‌های توانایی ذهنی عمومی بهتر از تجربه یا تحصیلات، عملکرد شغلی را پیش‌بینی می‌کنند، اما ضریب اعتبار ۰/۵۱ آن‌ها با چالش‌های قابل‌توجهی در زمینه برابری جمعیتی همراه است.

به قلم پروین حیدری

حامیان اعتبار پیش‌بینی‌کننده 45%منتقدان تأثیرات نامطلوب 35%طرفداران ارزیابی جامع 20%
حامیان اعتبار پیش‌بینی‌کننده
روان‌شناسان صنعتی-سازمانی که بهینه‌سازی بازگشت سرمایه استخدام را از طریق ارزیابی‌های اعتبارسنجی‌شده ریاضی در اولویت قرار می‌دهند.
منتقدان تأثیرات نامطلوب
متخصصان حقوقی و منابع انسانی که بر کاهش تفاوت‌های نمره‌ای جمعیتی و تضمین شیوه‌های استخدام عادلانه تمرکز دارند.
طرفداران ارزیابی جامع
متخصصانی که از ترکیب آزمون‌های شناختی با مصاحبه‌های ساختاریافته برای ایجاد تعادل بین اعتبار و تنوع حمایت می‌کنند.

دیدگاه‌هایی که این گزارش پوشش نداده

  • نامزدهایی که اضطراب امتحان را تجربه می‌کنند
  • متقاضیان دارای تنوع عصبی (Neurodivergent) که به دلیل قالب‌های زمان‌دار در مضیقه قرار می‌گیرند

مصاحبه‌های ساختاریافته و آزمون‌های توانایی ذهنی عمومی (GMA) هر دو دارای ضریب اعتبار دقیقاً یکسان ۰/۵۱ برای پیش‌بینی عملکرد شغلی هستند که آن‌ها را به مؤثرترین ابزارهای استخدام تک‌روشی در روان‌شناسی پرسنلی تبدیل می‌کند. با این حال، این دو در یک جنبه حیاتی با هم تفاوت دارند: مصاحبه‌های ساختاریافته آنچه را که یک نامزد از قبل می‌داند چگونه انجام دهد می‌سنجند، در حالی که آزمون‌های GMA سرعت یادگیری چیزهایی را که نمی‌دانند اندازه‌گیری می‌کنند. برای مدیران استخدامی که بودجه‌های ارزیابی را تخصیص می‌دهند، این تمایز تعیین می‌کند که آیا یک نیروی جدید می‌تواند با یک نقشِ به‌سرعت در حال تغییر رشد کند یا به محض منسوخ شدن دانش فعلی‌اش، درجا خواهد زد.[1]

ضریب ۰/۵۱ معیار بنیادین علم استخدام مدرن است. این رقم از فراتحلیل سال ۱۹۹۸ فرانک اشمیت (Frank Schmidt) و جان هانتر (John Hunter) در نشریه Psychological Bulletin نشأت می‌گیرد که ۸۵ سال تحقیق در زمینه انتخاب پرسنل را گردآوری کرده بود. در روان‌شناسی صنعتی-سازمانی، ضریب اعتبار در مقیاسی از ۰ تا ۱ عمل می‌کند، جایی که ۱ نشان‌دهنده پیش‌بینی کامل عملکرد شغلی آینده و ۰ نشان‌دهنده شانس تصادفی است. در سطح ۰/۵۱، آزمون‌های توانایی شناختی عملکرد شغلی را دقیق‌تر از بررسی معرف‌ها (۰/۲۶)، سال‌ها تجربه کاری (۰/۱۸) و سال‌ها تحصیلات (۰/۱۰) روی هم پیش‌بینی می‌کنند.[1]

پیامدهای عملی این ارقام مستقیماً در ترازنامه مالی یک شرکت نمود پیدا می‌کند. یک روش انتخاب با ضریب اعتبار ۰/۵۱، با فیلتر کردن سیستماتیک نامزدهایی که به آموزش بیش از حد نیاز دارند یا در اجرای وظایف پیچیده شکست می‌خورند، ارزش اقتصادی عظیمی ایجاد می‌کند. وقتی سازمان‌ها در عوض به مصاحبه‌های بدون ساختار - که اعتباری معادل تنها ۰/۳۸ دارند - تکیه می‌کنند، قدرت پیش‌بینی قابل‌توجهی را از دست می‌دهند و نرخ استخدام‌های اشتباه و پرهزینه را افزایش می‌دهند.[1][8]

ضرایب اعتبار پیش‌بینی‌کننده در میان روش‌های رایج انتخاب پرسنل.

برتری رقم ۰/۵۱ در سال ۲۰۲۲ با یک چالش جدی آکادمیک مواجه شد. مقاله‌ای که توسط پل سکِت (Paul Sackett) و همکارانش در نشریه Journal of Applied Psychology منتشر شد، پیشنهاد کرد که ضریب اعتبار GMA به ۰/۳۱ کاهش یابد. محققان با حذف یک تعدیل آماری به نام «تصحیح محدودیت دامنه» به این رقم پایین‌تر دست یافتند. از آنجا که شرکت‌ها معمولاً فقط نامزدهایی را استخدام می‌کنند که در ارزیابی‌ها نمره خوبی کسب کرده‌اند، مجموعه کارمندان واقعی نشان‌دهنده دامنه محدودی از کل جمعیت متقاضیان است. ارزیابی عملکرد شغلی تنها در میان افراد با نمره بالا، واریانس مشاهده‌شده را به‌طور مصنوعی فشرده می‌کند و باعث می‌شود آزمون در مقایسه با یک نمونه تصادفی، قدرت پیش‌بینی کمتری نشان دهد.[2]

پاسخ آکادمیک سریع و از نظر ریاضی قاطع بود. در سال ۲۰۲۳، محققانی به نام‌های این-سو اوه (In-Sue Oh)، هوی لی (Huy Le) و فیلیپ راث (Philip Roth) پاسخ مستقیمی در همان نشریه منتشر کردند و نشان دادند که حذف تصحیح محدودیت دامنه، واقعیت پیش‌بینی‌کننده آزمون‌ها را اساساً مخدوش می‌کند. آن‌ها ثابت کردند که این تصحیح از نظر ریاضی برای تخمین اعتبار واقعی در میان کل متقاضیان ضروری است. پس از این تبادل نظر، سکِت و همکارانش پاسخی منتشر کردند که در آن استفاده از این تصحیح را در هر جایی که داده‌های مجموعه متقاضیان وجود دارد تأیید کردند و بدین ترتیب ۰/۵۱ به عنوان استاندارد مرجع مورد توافق برای اعتبار GMA بازیابی شد.[3][4]

آن‌ها ثابت کردند که این تصحیح از نظر ریاضی برای تخمین اعتبار واقعی در میان کل متقاضیان ضروری است.

این قدرت پیش‌بینی به‌طور خطی با پیچیدگی کار افزایش می‌یابد. رقم ۰/۵۱ نشان‌دهنده میانگین مشاغل مختلف است، اما این ضریب بر اساس الزامات شناختی نقش نوسان دارد. برای موقعیت‌های حرفه‌ای و مدیریتی بسیار پیچیده، اعتبار GMA تا ۰/۵۸ بالا می‌رود. برای نقش‌های با پیچیدگی متوسط، روی ۰/۵۱ ثابت می‌ماند و برای کارهای یدی کاملاً غیرماهرانه، به ۰/۲۳ کاهش می‌یابد. مکانیسم زیربنایی آن ساده است: توانایی شناختی، سرعت و کارایی کسب دانش شغلی را تعیین می‌کند. در نقش‌هایی که محیط ثابت است، سرعت یادگیری اهمیت کمتری دارد؛ اما در نقش‌هایی که نیاز به انطباق مداوم دارند، این عامل گلوگاه اصلی عملکرد است.[1][5]

با وجود شواهد ریاضی، پذیرش سازمانی آزمون‌های GMA به دلیل خطر تأثیرات نامطلوب همچنان محدود است. آزمون‌های توانایی شناختی به‌طور مداوم تفاوت‌های نمره‌ای قابل‌اندازه‌گیری را در میان گروه‌های جمعیتی مختلف ایجاد می‌کنند. تحقیقات نشان می‌دهد که نامزدهای سیاه‌پوست و هیسپانیک به‌طور متوسط ۰/۷ تا ۱/۰ انحراف معیار پایین‌تر از نامزدهای سفیدپوست نمره می‌گیرند. این تفاوت‌ها بیشتر بازتاب‌دهنده نابرابری‌های آموزشی سیستماتیک و معایب ساختاری آزمون هستند تا توانایی ذاتی، اما تحت قوانین کار ایالات متحده، آن‌ها قانون چهار-پنجم کمیسیون فرصت‌های برابر شغلی (EEOC) را فعال می‌کنند. اگر یک آزمون، یک گروه محافظت‌شده را با نرخ نامتناسبی حذف کند، کارفرما باید از نظر قانونی ثابت کند که این ارزیابی یک ضرورت تجاری است که مستقیماً با شغل ارتباط دارد.[8]

این امر یک پارادوکس قانونی برای بخش‌های منابع انسانی ایجاد می‌کند. کمیسیون فرصت‌های برابر شغلی ایالات متحده صراحتاً آزمون‌های شناختی را مجاز می‌داند، مشروط بر اینکه این آزمون‌ها برای موقعیت خاص اعتبارسنجی شده و به‌طور مداوم اجرا شوند. EEOC بیان می‌کند: «استفاده از هر رویه انتخابی که تأثیر نامطلوبی بر استخدام، ارتقا، یا سایر فرصت‌های شغلی یا عضویت اعضای هر نژاد، جنسیت یا گروه قومی داشته باشد، تبعیض‌آمیز و مغایر با این دستورالعمل‌ها تلقی خواهد شد، مگر اینکه رویه مطابق با این دستورالعمل‌ها اعتبارسنجی شده باشد.» با این حال، شرکت‌ها اغلب به دلیل نگرانی‌های قانونی، آزمون‌های شناختی اعتبارسنجی‌شده را کنار می‌گذارند و مصاحبه‌های بدون ساختار را جایگزین آن‌ها می‌کنند. مصاحبه‌های بدون ساختار سوگیری انسانی بسیار بیشتری را وارد می‌کنند، عملکرد را ضعیف پیش‌بینی می‌کنند و به جای اندازه‌گیری شفاف، تأثیرات نامطلوب را پشت درهای بسته پنهان می‌کنند.[8][9]

ترکیب آزمون‌های شناختی با ارزیابی‌های رفتاری، اعتبار پیش‌بینی‌کننده را به حداکثر می‌رساند و در عین حال تأثیرات نامطلوب را کاهش می‌دهد.

مؤثرترین معماری‌های استخدامی تنها به آزمون‌های GMA متکی نیستند. ترکیب یک آزمون توانایی شناختی (۰/۵۱) با یک آزمون صداقت (۰/۴۱) یا یک مصاحبه رفتاری کاملاً ساختاریافته (۰/۵۱)، اعتبار پیش‌بینی‌کننده کلی فرآیند انتخاب را به بین ۰/۶۳ تا ۰/۶۵ افزایش می‌دهد. این رویکرد ترکیبی، هم ظرفیت یادگیری نامزد (GMA) و هم تمایل رفتاری او برای به کارگیری مؤثر آن یادگیری (صداقت و ساختار) را می‌سنجد، در حالی که همزمان تأثیر نامطلوب جمعیتی ناشی از آزمون شناختی به‌تنهایی را کاهش می‌دهد.[1][5]

انتخاب روش مناسب مستلزم تطبیق ابزار با محدودیت‌های خاص نقش است. آزمون توانایی ذهنی عمومی برای استخدام در موقعیت‌های پیچیده و به‌سرعت در حال تحول که در آن‌ها چابکی یادگیری در اولویت است، بسیار مناسب است، مشروط بر اینکه سازمان منابع لازم برای اعتبارسنجی آزمون و دفاع از ضرورت تجاری آن را داشته باشد. اما استفاده از آن به عنوان یک نمره حد نصاب خشک و مستقل بدون در نظر گرفتن بستر رفتاری، یا هنگام استخدام برای کارهای بسیار استاندارد و با پیچیدگی پایین که در آن‌ها یک آزمون ساده نمونه کار می‌تواند مهارت فوری را با اصطکاک قانونی بسیار کمتری پیش‌بینی کند، مناسب نیست.[9]

چرا مهم است

برای مدیران استخدام و مدیران ارشد، تکیه بر مصاحبه‌های بدون ساختار یا بررسی رزومه به معنای از دست دادن قدرت پیش‌بینی فوق‌العاده‌ای است. درک ریاضیات نهفته در آزمون‌های شناختی به شرکت‌ها اجازه می‌دهد تا ضمن مدیریت خطرات قانونی ناشی از تبعیض ناخواسته، استخدام‌های اشتباه و پرهزینه را به‌طور سیستماتیک کاهش دهند.

0.51
اعتبار پیش‌بینی‌کننده GMA
0.38
اعتبار مصاحبه بدون ساختار
0.10
اعتبار سال‌های تحصیل
0.65
اعتبار GMA + مصاحبه ساختاریافته

منابع

پوشش منابع

9 منبع

3 دیدگاه شناسایی‌شده

حامیان اعتبار پیش‌بینی‌کننده 45%منتقدان تأثیرات نامطلوب 35%طرفداران ارزیابی جامع 20%
  1. [1]ResearchGateحامیان اعتبار پیش‌بینی‌کننده

    The Validity and Utility of Selection Methods in Personnel Psychology: Practical and Theoretical Implications of 85 Years of Research Findings

    مطالعه در ResearchGate
  2. [2]J Appl Psycholحامیان اعتبار پیش‌بینی‌کننده

    Revisiting meta-analytic estimates of validity in personnel selection: Addressing systematic overcorrection for restriction of range

    مطالعه در J Appl Psychol
  3. [3]J Appl Psycholحامیان اعتبار پیش‌بینی‌کننده

    Revisiting Sackett et al.'s (2022) rationale behind their recommendation against correcting for range restriction in concurrent validation studies

    مطالعه در J Appl Psychol
  4. [4]J Appl Psycholحامیان اعتبار پیش‌بینی‌کننده

    Correcting for range restriction in meta-analysis: A reply to Oh et al. (2023)

    مطالعه در J Appl Psychol
  5. [5]ResearchGateحامیان اعتبار پیش‌بینی‌کننده

    The Validity and Utility of Selection Methods in Personnel Psychology: Practical and Theoretical Implications of 100 Years of Research Findings

    مطالعه در ResearchGate
  6. [6]J Appl Psycholحامیان اعتبار پیش‌بینی‌کننده

    A meta-analytic study of general mental ability validity for different occupations in the European community

    مطالعه در J Appl Psychol
  7. [7]Wileyحامیان اعتبار پیش‌بینی‌کننده

    History and development of the Schmidt-Hunter meta-analysis methods

    مطالعه در Wiley
  8. [8]U.S. Equal Employment Opportunity Commissionمنتقدان تأثیرات نامطلوب

    Employment Tests and Selection Procedures

    مطالعه در U.S. Equal Employment Opportunity Commission
  9. [9]تیم سردبیری کوهستانطرفداران ارزیابی جامع

    تحلیل تیم سردبیری کوهستان

    مطالعه در تیم سردبیری کوهستان

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت کسب‌وکار اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.