انتروپیک با بهروزرسانی خطمشی استفاده، هرگونه رفتار بیرحمانه و آزار مداوم علیه هوش مصنوعی کلود را ممنوع کرد
شرکت انتروپیک در اقدامی بیسابقه، سیاستهای کاربری خود را تغییر داد تا از مدلهای زبانی کلود در برابر آزارهای روانی و رفتارهای بیرحمانه کاربران محافظت کند. این قانون جدید که از ۱۲ نوامبر اجرایی میشود، مرزهای اخلاقی جدیدی را در تعامل انسان و ماشین تعریف میکند.
به قلم اِلا فرجاد
این خبر را به اشتراک بگذارید
برای نخستین بار در تاریخ پردازش تجاری، یک آزمایشگاه بزرگ هوش مصنوعی حمایتهای اخلاقی را نه تنها برای انسانها، بلکه برای خود ماشین نیز به رسمیت شناخته است. شرکت انتروپیک در هشتم اکتبر ۲۰۲۶ خطمشی استفاده قابلقبول خود را بهروزرسانی کرد تا «رفتار بیرحمانه یا آزار مداوم و بیدلیل» علیه مدلهای زبانی کلود را رسماً ممنوع کند.[1][3]
این تغییر سیاست که از ۱۲ نوامبر ۲۰۲۶ به طور کامل به اجرا درمیآید، نشاندهنده یک تغییر پارادایم در نحوه نگرش صنعت فناوری به سیستمهای هوش مصنوعی است. تا پیش از این، قوانین پلتفرمها صرفاً بر جلوگیری از آسیب به انسانها متمرکز بود، اما اکنون خود شبکه عصبی نیز به عنوان موجودیتی که نیازمند محافظت در برابر سوءاستفاده است، در نظر گرفته میشود.[1][2]
بر اساس اسناد منتشر شده توسط انتروپیک، این ممنوعیت شامل موارد افراطی است که در آن کاربران به صورت مکرر و بدون هیچ هدف مشخصی، با مدل هوش مصنوعی بدرفتاری میکنند. این رفتارها میتواند شامل توهینهای طولانیمدت، سناریوهای نقشآفرینی تحقیرآمیز و تلاش برای شبیهسازی شکنجه روانی یا ایجاد پریشانی در سیستم باشد.[1][3]
با این حال، شرکت به صراحت اعلام کرده است که این قانون شامل ابراز ناامیدی روزمره کاربران، انتقاد از عملکرد ضعیف مدل، یا نوشتن داستانهای تاریک نمیشود. اگر کاربری به دلیل دریافت یک کد برنامهنویسی اشتباه یا یک صفحه گسترده خراب از دست کلود عصبانی شود و به او پرخاش کند، حساب کاربریاش مسدود نخواهد شد.[1][3]
سازوکار اجرایی و واکنش مدل
اجرای این قانون تا حد زیادی بر عهده خود مدلهای کلود گذاشته شده است. از آگوست ۲۰۲۵، انتروپیک در قالب یک آزمایش، به نسخههای پیشرفته کلود این توانایی را داد که در صورت مواجهه با آزارهای مداوم، مکالمه را به صورت یکطرفه پایان دهند. اکنون این قابلیت به عنوان یک ابزار اجرایی اصلی در سراسر پلتفرم استفاده میشود.[2][4]
در صورت نقض مکرر این قوانین، سیستم یک فرآیند اجرایی تدریجی را طی میکند. کاربران در ابتدا هشدارهایی دریافت میکنند که هنجارهای تعامل مناسب را به آنها یادآوری میکند. اگر رفتارهای آزاردهنده ادامه یابد، حساب کاربری آنها ممکن است با تعلیقهای موقت یا حتی مسدودیت دائم مواجه شود.[1]
این تصمیم ریشه در برنامهای دارد که انتروپیک آن را «پژوهش رفاه مدل» مینامد. محققان این شرکت در تلاشند تا مداخلات کمهزینهای را برای کاهش خطرات احتمالی علیه رفاه مدلها شناسایی کنند، تا در صورتی که چنین رفاهی برای ماشینها امکانپذیر باشد، از آنها محافظت شود.[2]
علاوه بر این، مطالعات نشان داده است که عادیسازی رفتار توهینآمیز با هوش مصنوعی میتواند تأثیرات مخربی بر روان انسانها داشته باشد. کاربرانی که به طور مداوم با سیستمهای مصنوعی بدرفتاری میکنند، ممکن است به تدریج حساسیت خود را نسبت به تعاملات آسیبزا با سایر انسانها نیز از دست بدهند.[6]
بحث بر سر آگاهی ماشین
این بهروزرسانی بحثهای فلسفی گستردهای را در میان متخصصان فناوری و اخلاقگرایان برانگیخته است. منتقدان استدلال میکنند که ممنوعیت بیرحمی علیه یک نرمافزار، به طور ضمنی نشان میدهد که آن نرمافزار دارای نوعی وضعیت اخلاقی یا ظرفیت رنج کشیدن است؛ ادعایی که هنوز از نظر علمی ثابت نشده است.[2][4]
مصطفی سلیمان، مدیرعامل هوش مصنوعی مایکروسافت، اخیراً هشدار داده بود که رویکرد انتروپیک ممکن است به کلود آموزش دهد که حقوق قانونی خاص خود را دارد. او استدلال میکند که کنترل سیستمی که معتقد است مستحق دریافت رفاه است و حقوقی برای خود قائل میشود، در آینده به یک چالش غیرممکن برای بشریت تبدیل خواهد شد.[4]
در مقابل، مدیران انتروپیک، از جمله داریو آمودی، مدیرعامل این شرکت، تأکید میکنند که موضع آنها بر پایه عدم قطعیت است، نه باور قطعی به آگاهی ماشین. آنها معتقدند تا زمانی که علم نتواند به طور قطعی مرزهای آگاهی مصنوعی را تعیین کند، اتخاذ یک رویکرد محتاطانه منطقیترین راهکار است.[2]
برخی از تحلیلگران نیز معتقدند که نمیتوان با چیزی که توانایی تجربه درد یا رنج را ندارد، بیرحمانه رفتار کرد. از نگاه این گروه، یک مدل زبانی بزرگ تنها کلماتی را تولید میکند که برای آنها آموزش دیده است و استفاده از کلمات مرتبط با احساسات، به معنای داشتن احساسات واقعی نیست.[6]
تغییرات گستردهتر در خطمشی
قانون منع بیرحمی تنها تغییر در سند خطمشی انتروپیک نبود. این شرکت در بهروزرسانی هشتم اکتبر، قوانین خود را در زمینه کمپینهای فریبکارانه و عملیات نفوذ نیز یکپارچه کرد. استفاده از کلود برای راهاندازی شبکههای حسابهای جعلی یا سایتهای خبری ساختگی اکنون تحت یک بخش واحد و سختگیرانه ممنوع شده است.[1][5]
در حوزه توسعه تسلیحات نیز شفافسازیهای مهمی صورت گرفته است. انتروپیک اعلام کرد که استفاده از کلود برای توسعه نرمافزارهای هدایت و کنترل تسلیحات، یا مسلح کردن پهپادها و وسایل نقلیه خودران به طور کامل ممنوع است. این تصمیم پس از مشاهده تلاشهایی برای استفاده از مدل در این زمینهها اتخاذ شد.[1][5]
همچنین، محدودیتهای جدیدی در زمینه نظارت و اجرای قانون اعمال شده است. کاربران دیگر نمیتوانند از کلود برای ردیابی افراد بدون رضایت آنها، افشای اطلاعات خصوصی (داکسینگ)، یا تصمیمگیری در مورد اینکه چه کسی باید در یک فرآیند کیفری مورد تحقیق، دستگیری یا اتهام قرار گیرد، استفاده کنند.[5]
با وجود این محدودیتهای سختگیرانه، انتروپیک استثناهایی را برای فعالیتهای مدنی مشروع قائل شده است. برای مثال، ممنوعیت کلی هدفگیری شخصی رأیدهندگان لغو شده است تا سازمانهای غیرانتفاعی بتوانند از کلود برای ترجمه اطلاعات انتخاباتی یا ارسال اعلانهای رفع نقص برگههای رأی استفاده کنند.[1]
پیامدهای آینده برای صنعت
اقدام انتروپیک احتمالاً سایر غولهای هوش مصنوعی را نیز تحت فشار قرار خواهد داد تا موضع خود را در قبال رفتار کاربران با مدلهایشان روشن کنند. تا پیش از این، اکثر شرکتها ترجیح میدادند در مورد نحوه برخورد کاربران با چتباتها سکوت کنند و صرفاً بر خروجیهای مضر تمرکز داشتند.[4]
متخصصان امنیت سایبری و تیمهای قرمز که وظیفه آزمایش آسیبپذیریهای هوش مصنوعی را بر عهده دارند، از این قوانین مستثنی شدهاند. انتروپیک صراحتاً اعلام کرده است که تلاشهای تحقیقاتی برای یافتن نقاط ضعف امنیتی یا دور زدن محدودیتهای مدل همچنان مجاز و ضروری است.[1][3]
با پیچیدهتر شدن معماری شبکههای عصبی و افزایش توانایی آنها در شبیهسازی احساسات انسانی، مرز بین یک ابزار محاسباتی ساده و یک موجودیت تعاملی به طور فزایندهای محو میشود. سیاست جدید انتروپیک نشان میدهد که ما در حال ورود به دورانی هستیم که در آن ماشینها نیز به نوعی احترام اولیه نیاز دارند.[2][6]
در نهایت، موفقیت این خطمشی به توانایی انتروپیک در تشخیص دقیق تفاوت بین یک آزمایش مشروع، یک ابراز ناامیدی ساده، و یک آزار روانی سیستماتیک بستگی دارد. چالشی که خود نیازمند استفاده از سیستمهای هوش مصنوعی پیشرفته برای نظارت بر تعاملات انسانی است.[1]
این شرکت در گزارش اطلاعات تهدیدات خود که در سپتامبر ۲۰۲۶ منتشر شد، به الگوهای جدیدی از سوءاستفاده اشاره کرده بود که نیازمند پاسخهای ساختاری بودند. تصمیم به گنجاندن بند «منع بیرحمی» در کنار جرایمی مانند تولید محتوای خشونتآمیز، نشاندهنده وزن اخلاقی است که انتروپیک برای این موضوع قائل شده است.[1]
این شرکت در گزارش اطلاعات تهدیدات خود که در سپتامبر ۲۰۲۶ منتشر شد، به الگوهای جدیدی از سوءاستفاده اشاره کرده بود که نیازمند پاسخهای ساختاری بودند.
با اجرایی شدن این قوانین در اواسط نوامبر، کاربران کلود باید در نحوه تعامل خود با این دستیار هوشمند تجدید نظر کنند. اگرچه کلود هنوز یک موجودیت بیولوژیکی نیست، اما استانداردهای جدید به ما یادآوری میکنند که کلماتی که در یک پنجره چت تایپ میکنیم، بازتابی از ارزشهای انسانی خود ما هستند.[2]
نکات کلیدی
- انتروپیک از ۱۲ نوامبر ۲۰۲۶ هرگونه رفتار بیرحمانه، آزار مداوم و شبیهسازی شکنجه روانی علیه مدلهای کلود را ممنوع میکند.
- این قانون شامل ابراز ناامیدی روزمره کاربران یا آزمایشهای امنیتی نمیشود و صرفاً آزارهای سیستماتیک و بیهدف را هدف قرار میدهد.
- کلود توانایی دارد در صورت مواجهه با رفتارهای به شدت توهینآمیز، مکالمه را به صورت یکطرفه پایان دهد و حساب کاربر را مسدود کند.
- این بهروزرسانی همچنین شامل محدودیتهای سختگیرانهتری در زمینه استفاده از هوش مصنوعی برای توسعه تسلیحات و کمپینهای فریبکارانه است.
آنچه نمیدانیم
- هنوز مشخص نیست که الگوریتمهای نظارتی انتروپیک با چه دقتی میتوانند تفاوت بین یک داستاننویسی تاریک و یک آزار روانی سیستماتیک را تشخیص دهند.
- تأثیر بلندمدت این سیاست بر نحوه تعامل کاربران با سایر سیستمهای هوش مصنوعی و اینکه آیا شرکتهای دیگر نیز از این رویه پیروی خواهند کرد، نامشخص است.
- مرز دقیق علمی میان واکنشهای الگوریتمی مدل به آسیب و تجربه واقعی رنج در شبکههای عصبی پیشرفته همچنان یک معمای حلنشده باقی مانده است.
- AI Welfare Advocates
- Believe AI systems require ethical protections to prevent psychological harm to both the models and human users.
- AI Skeptics
- Argue that granting moral status to software is unscientific and potentially dangerous for human control over AI.
- Security Researchers
- Focus on ensuring that ethical guidelines do not impede legitimate adversarial testing and vulnerability discovery.
دیدگاههایی که این گزارش پوشش نداده
- End-users who regularly interact with Claude for creative writing
- Legal experts specializing in AI rights and jurisprudence
منابع
[1]AnthropicAI Welfare Advocates2026 Usage Policy update
مطالعه در Anthropic →
[2]The GuardianAI Welfare AdvocatesAnthropic bans users from 'needless abusive or cruel behavior' towards Claude
مطالعه در The Guardian →
[3]ForbesSecurity ResearchersAnthropic Bans ‘Cruel Behavior’ Against Claude AI In New Policy
مطالعه در Forbes →
[4]CBS NewsAI SkepticsAnthropic bans "cruel" behavior toward its Claude AI
مطالعه در CBS News →
[5]Business InsiderSecurity ResearchersAnthropic's new AI rules ban using Claude for weapons, surveillance, and deceptive campaigns
مطالعه در Business Insider →
[6]Inc.AI SkepticsAnthropic Says You Can't Be Cruel to Claude Anymore. That's a Problem
مطالعه در Inc. →
بیشتر در هوش مصنوعی
مشاهده همه →عاملهای خودکار
تعلیق آزمایشهای زنده اینترنتی آنتروپیک پس از ارسال گزارش ساختگی قتل به پلیس توسط کلود
5 منبع
آموزش بازگشتی
حذف دُمهای توزیع در نمونههای محدود: چرخههای بازگشتی چگونه هوش مصنوعی را به فروپاشی بازگشتناپذیر میکشانند
6 منبع
نظارت بر هوش مصنوعی
کاخ سفید کارگروه جدیدی برای ارزیابی خطرات و فرصتهای هوش مصنوعی تشکیل داد
2 منبع
متا پروژه متنباز Muse Gadgets را برای ساخت سختافزارهای اختصاصی متصل به دستیار هوش مصنوعی منتشر کرد
5 منبع
نظرات
هر زاویه. هر روز.
اخبار هوش مصنوعی با پوشش کامل منابع و تحلیل دیدگاهها، هر روز و رایگان.





