رفتن به محتوای اصلی
Koohestun
پژوهش کوهستانشرطی‌سازی عاملبسته شواهد· 5 دقیقه مطالعه· در علم

نسبت ثابت، نسبت متغیر، فاصله ثابت و فاصله متغیر: چهار برنامه تقویتی که پایداری رفتار را دیکته می‌کنند

زمان‌بندی دقیق و دفعات ارائه پاداش، میزان پایداری یک رفتار را تعیین می‌کند. با دستکاری در پیش‌بینی‌پذیر بودن یا تصادفی بودن تقویت‌کننده‌ها، و اینکه آیا به زمان وابسته‌اند یا به عمل، سیستم‌ها می‌توانند عادت‌هایی بسازند که در برابر خاموشی مقاومت کنند.

به قلم الوین شادمهر

روان‌شناسان رفتاری 40%دانشمندان علوم شناختی 35%طراحان تجربه کاربردی 25%
روان‌شناسان رفتاری
تمرکز بر رابطه تجربی و قابل اندازه‌گیری بین محرک‌های محیطی و خروجی رفتاری.
دانشمندان علوم شناختی
تاکید بر نقش حالات ذهنی درونی، انتظارات و انگیزه درونی در اصلاح پاسخ‌ها به برنامه‌ها.
طراحان تجربه کاربردی
اعمال برنامه‌های تقویتی برای به حداکثر رساندن درگیری کاربر در محیط‌های دیجیتال و تجاری.

دیدگاه‌هایی که این گزارش پوشش نداده

  • متخصصان اخلاق که اخلاقی بودن استفاده از برنامه‌های نسبت متغیر در فناوری‌های مصرف‌کننده را بررسی می‌کنند
  • عصب‌زیست‌شناسانی که مسیرهای خاص دوپامین فعال‌شده توسط پاداش‌های غیرقابل پیش‌بینی را نقشه‌برداری می‌کنند

معمار یک محیط رفتاری — چه یک محقق آزمایشگاه باشد، چه طراح بازی‌های ویدیویی یا یک مدیر — دقیقاً دو اهرم را کنترل می‌کند: معیارهای لازم برای فعال کردن یک پاداش، و لحظه‌ای که آن پاداش ارائه می‌شود. با تنظیم این متغیرها، آن‌ها نه تنها تعیین می‌کنند که آیا سوژه یک رفتار را یاد می‌گیرد یا خیر، بلکه مشخص می‌کنند که وقتی پاداش‌ها کمیاب شوند، سوژه با چه شدتی برای انجام آن پافشاری خواهد کرد.[2][6]

این مکانیسم که به عنوان شرطی‌سازی عامل (operant conditioning) شناخته می‌شود، بر چهار برنامه متمایز تقویت جزئی متکی است. سیستم به جای پاداش دادن به یک عمل در هر بار وقوع، پرداخت‌ها را فاصله‌گذاری می‌کند. شواهد نشان می‌دهد که تقویت جزئی رفتارهایی را ایجاد می‌کند که به طور قابل‌توجهی در برابر خاموشی — اصطلاح روان‌شناختی برای از بین رفتن یک عادت هنگام توقف پاداش‌ها — مقاوم‌تر هستند.[2][5]

اولین اهرمی که طراح کنترل می‌کند، مبنای پاداش است: آیا به تعداد اقدامات انجام‌شده گره خورده است (که به عنوان برنامه نسبتی شناخته می‌شود) یا به مقدار زمانی که سپری شده است (برنامه فاصله‌ای)؟ اهرم دوم پیش‌بینی‌پذیری است: آیا این الزام ثابت است، یا به طور تصادفی حول یک میانگین تغییر می‌کند؟[6]

چهار برنامه اصلی تقویت جزئی بر اساس پیش‌بینی‌پذیری و مبنای آن‌ها در زمان در برابر عمل تعریف می‌شوند.

برنامه‌های «نسبت ثابت» پس از یک تعداد پاسخ مشخص و قابل پیش‌بینی، تقویت را ارائه می‌دهند. یک کارگر کارخانه که به ازای هر ۱۰ کالای تولیدشده دستمزد می‌گیرد، یا موشی که دقیقاً پس از پنج بار فشردن اهرم یک گلوله غذا دریافت می‌کند، بر اساس این برنامه عمل می‌کنند. داده‌ها نشان می‌دهد که این امر نرخ پاسخ بالایی تولید می‌کند، اما با یک «وقفه پس از تقویت» متمایز همراه است — یک دوره کوتاه بی‌تحرکی بلافاصله پس از پاداش، پیش از آنکه سوژه کار برای رسیدن به سهمیه بعدی را آغاز کند.[2][4][6]

در مقابل، برنامه‌های «نسبت متغیر» پاداش‌ها را پس از تعداد غیرقابل پیش‌بینی از پاسخ‌ها ارائه می‌دهند. سوژه می‌داند که عمل باعث پاداش می‌شود، اما هرگز دقیقاً نمی‌داند کدام عمل آن را فعال خواهد کرد. ماشین‌های اسلات (بخت‌آزمایی) کاربرد کلاسیک انسانی این معماری هستند. از آنجا که کشیدن بعدی اهرم همیشه می‌تواند برنده باشد، متن روان‌شناسی OpenStax خاطرنشان می‌کند که برنامه‌های نسبت متغیر «مولدترین و مقاوم‌ترین در برابر خاموشی» هستند.[2][5]

در مقابل، برنامه‌های «نسبت متغیر» پاداش‌ها را پس از تعداد غیرقابل پیش‌بینی از پاسخ‌ها ارائه می‌دهند.

برنامه‌های «فاصله ثابت» به اولین اقدام انجام‌شده پس از سپری شدن یک مقدار زمان مشخص و قابل پیش‌بینی پاداش می‌دهند. بیمارستانی که در آن بیمار فقط هر چهار ساعت یک‌بار می‌تواند داروی مسکن دریافت کند، بر اساس این برنامه عمل می‌کند. خروجی رفتاری در اینجا شکل دالبری به خود می‌گیرد: سوژه‌ها بلافاصله پس از پاداش کار بسیار کمی انجام می‌دهند، اما با نزدیک شدن به محدودیت زمانی، اقدامات خود را به سرعت شتاب می‌بخشند.[2][4][6]

برنامه‌های «فاصله متغیر» به اولین اقدام پس از یک مقدار زمان غیرقابل پیش‌بینی پاداش می‌دهند. بررسی ایمیل یا اعلان‌های شبکه‌های اجتماعی بر اساس این برنامه کار می‌کند؛ پیام‌ها در زمان‌های تصادفی می‌رسند و بررسی کردن تنها در صورتی پاداش به همراه دارد که زمان کافی برای رسیدن یک پیام جدید سپری شده باشد. این امر یک نرخ پاسخ متوسط و پیوسته را بدون وقفه‌هایی که در برنامه‌های ثابت دیده می‌شود، تولید می‌کند.[2][6]

هر برنامه یک امضای ریاضی متمایز در خروجی رفتاری تولید می‌کند، به طوری که نسبت متغیر تندترین منحنی پاسخ را ایجاد می‌کند.

متن بنیادین در مورد این معماری، یعنی کتاب «برنامه‌های تقویت» که در سال ۱۹۵۷ توسط بی.اف. اسکینر و چارلز فرستر منتشر شد، بیش از ۷۰,۰۰۰ ساعت داده رفتاری را برای نقشه‌برداری از این روابط دقیق ریاضی ثبت کرد. داده‌های آن‌ها ثابت کرد که برنامه‌های نسبتی به طور مداوم نرخ پاسخ بالاتری نسبت به برنامه‌های فاصله‌ای ایجاد می‌کنند، زیرا سرعت خود سوژه مستقیماً فرکانس پاداش را کنترل می‌کند.[1][5]

با این حال، اعمال این برنامه‌ها در رفتار اجتماعی پیچیده انسانی متغیرهای قابل‌توجهی را معرفی می‌کند. در حالی که یک موش در جعبه اسکینر تنها یک اهرم و یک منبع غذا دارد، انسان‌ها در محیط‌هایی با تقویت‌کننده‌های رقیب عمل می‌کنند. یک تحلیل در سال ۱۹۹۴ در ژورنال تحلیل تجربی رفتار اشاره کرد که اگرچه مدل‌های ریاضی تقویت در محیط‌های کنترل‌شده معتبر هستند، اما پیش‌بینی دقیق تکانه رفتاری در محیط‌های باز نیازمند در نظر گرفتن پاداش‌های جایگزینِ در دسترس است.[3][4]

شواهد در مورد خاموشی قوی‌ترین است. وقتی محققان پاداش را به طور کامل حذف می‌کنند، رفتارهای ساخته‌شده بر اساس برنامه‌های متغیر بسیار طولانی‌تر از رفتارهای مبتنی بر برنامه‌های ثابت دوام می‌آورند. از آنجا که سوژه از قبل به دوره‌های خشک طولانی و غیرقابل پیش‌بینی بدون تقویت عادت کرده است، مدت‌ها پس از آنکه سیستم واقعاً پرداخت را متوقف کرده است، به انجام عمل ادامه می‌دهد.[2][6]

محفظه شرطی‌سازی عامل به محققان اجازه داد تا اثرات دقیق زمان‌بندی‌های مختلف تقویت را ایزوله و اندازه‌گیری کنند.

آنچه کمتر واضح باقی می‌ماند این است که این برنامه‌ها چگونه با انگیزه درونی تعامل دارند. در حالی که داده‌ها به شدت از اثربخشی برنامه‌های نسبت متغیر در هدایت حجم رفتاری خام پشتیبانی می‌کنند، محققان هشدار می‌دهند که اتکای کامل به پاداش‌های تصادفی و بیرونی گاهی اوقات می‌تواند تمایل درونی سوژه برای انجام کار به خاطر خود آن کار را تضعیف کند.[3]

مرز این مدل در آستانه دقیقی قرار دارد که در آن یک برنامه پاداش بیرونی، انگیزه درونی سوژه انسانی را به طور دائم تخریب می‌کند. شناسایی نقطه خاصی که در آن یک برنامه نسبت متغیر، ساختن یک عادت مقاوم را متوقف کرده و شروع به فرسایش نیروی محرکه درونی می‌کند، همچنان یک سوال باز در تحلیل تجربی رفتار اجتماعی است.[3][7]

4
برنامه‌های اصلی تقویت جزئی
2
متغیرهای هسته‌ای دستکاری‌شده (مبنا و پیش‌بینی‌پذیری)
70,000
ساعت‌های داده‌های رفتاری در متن بنیادین سال ۱۹۵۷

آنچه نمی‌دانیم

  • اینکه دقیقاً چگونه تقویت‌کننده‌های رقیب در محیط‌های اجتماعی باز و پیچیده، پیش‌بینی‌های ریاضیاتی مدل‌های عامل ایزوله را تغییر می‌دهند.
  • آستانه دقیقی که در آن پاداش‌های تصادفی و بیرونی شروع به تخریب دائمی انگیزه درونی سوژه انسانی برای انجام یک کار می‌کنند.

اصطلاحات کلیدی

شرطی‌سازی عامل
فرآیند یادگیری که در آن رفتار توسط پیامدهای آن، مانند پاداش‌ها یا مجازات‌ها، اصلاح می‌شود.
خاموشی
تضعیف تدریجی و ناپدید شدن یک رفتار شرطی‌شده زمانی که دیگر تقویت نمی‌شود.
تقویت پیوسته
برنامه‌ای که در آن هر بار که رفتار مطلوب انجام می‌شود، پاداش ارائه می‌گردد.
تقویت جزئی
برنامه‌ای که در آن پاداش‌ها تنها در برخی مواقع ارائه می‌شوند و رفتار را در برابر خاموشی مقاوم‌تر می‌کنند.
وقفه پس از تقویت
یک دوره کوتاه بی‌تحرکی که معمولاً پس از ارائه پاداش در برنامه‌های ثابت رخ می‌دهد.

منابع

پوشش منابع

7 منبع

3 دیدگاه شناسایی‌شده

روان‌شناسان رفتاری 40%دانشمندان علوم شناختی 35%طراحان تجربه کاربردی 25%
  1. [1]HathiTrust Digital Library

    Catalog Record: Schedules of reinforcement

    مطالعه در HathiTrust Digital Library
  2. [2]OpenStaxدانشمندان علوم شناختی

    6.3 Operant Conditioning - Psychology 2e

    مطالعه در OpenStax
  3. [3]PMCطراحان تجربه کاربردی

    The role of schedules of reinforcement in the experimental analysis of social behavior

    مطالعه در PMC
  4. [4]Journal of the Experimental Analysis of Behaviorروان‌شناسان رفتاری

    Theory of reinforcement schedules

    مطالعه در Journal of the Experimental Analysis of Behavior
  5. [5]B. F. Skinner Foundationروان‌شناسان رفتاری

    Schedules of Reinforcement – B. F. SKINNER FOUNDATION

    مطالعه در B. F. Skinner Foundation
  6. [6]Lumen Learningدانشمندان علوم شناختی

    Reinforcement Schedules

    مطالعه در Lumen Learning
  7. [7]تیم سردبیری کوهستان

    تحلیل تیم سردبیری کوهستان

    مطالعه در تیم سردبیری کوهستان

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت علم اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.