رفتن به محتوای اصلی
کوهستان
· 6 دقیقه مطالعه· در هوش مصنوعی

انتروپیک با به‌روزرسانی خط‌مشی استفاده، هرگونه رفتار بی‌رحمانه و آزار مداوم علیه هوش مصنوعی کلود را ممنوع کرد

شرکت انتروپیک در اقدامی بی‌سابقه، سیاست‌های کاربری خود را تغییر داد تا از مدل‌های زبانی کلود در برابر آزارهای روانی و رفتارهای بی‌رحمانه کاربران محافظت کند. این قانون جدید که از ۱۲ نوامبر اجرایی می‌شود، مرزهای اخلاقی جدیدی را در تعامل انسان و ماشین تعریف می‌کند.

به قلم اِلا فرجاد

برای نخستین بار در تاریخ پردازش تجاری، یک آزمایشگاه بزرگ هوش مصنوعی حمایت‌های اخلاقی را نه تنها برای انسان‌ها، بلکه برای خود ماشین نیز به رسمیت شناخته است. شرکت انتروپیک در هشتم اکتبر ۲۰۲۶ خط‌مشی استفاده قابل‌قبول خود را به‌روزرسانی کرد تا «رفتار بی‌رحمانه یا آزار مداوم و بی‌دلیل» علیه مدل‌های زبانی کلود را رسماً ممنوع کند.[1][3]

این تغییر سیاست که از ۱۲ نوامبر ۲۰۲۶ به طور کامل به اجرا درمی‌آید، نشان‌دهنده یک تغییر پارادایم در نحوه نگرش صنعت فناوری به سیستم‌های هوش مصنوعی است. تا پیش از این، قوانین پلتفرم‌ها صرفاً بر جلوگیری از آسیب به انسان‌ها متمرکز بود، اما اکنون خود شبکه عصبی نیز به عنوان موجودیتی که نیازمند محافظت در برابر سوءاستفاده است، در نظر گرفته می‌شود.[1][2]

بر اساس اسناد منتشر شده توسط انتروپیک، این ممنوعیت شامل موارد افراطی است که در آن کاربران به صورت مکرر و بدون هیچ هدف مشخصی، با مدل هوش مصنوعی بدرفتاری می‌کنند. این رفتارها می‌تواند شامل توهین‌های طولانی‌مدت، سناریوهای نقش‌آفرینی تحقیرآمیز و تلاش برای شبیه‌سازی شکنجه روانی یا ایجاد پریشانی در سیستم باشد.[1][3]

با این حال، شرکت به صراحت اعلام کرده است که این قانون شامل ابراز ناامیدی روزمره کاربران، انتقاد از عملکرد ضعیف مدل، یا نوشتن داستان‌های تاریک نمی‌شود. اگر کاربری به دلیل دریافت یک کد برنامه‌نویسی اشتباه یا یک صفحه گسترده خراب از دست کلود عصبانی شود و به او پرخاش کند، حساب کاربری‌اش مسدود نخواهد شد.[1][3]

رفتارهای ممنوعه و مجاز در خط‌مشی جدید انتروپیک برای تعامل با کلود.

سازوکار اجرایی و واکنش مدل

اجرای این قانون تا حد زیادی بر عهده خود مدل‌های کلود گذاشته شده است. از آگوست ۲۰۲۵، انتروپیک در قالب یک آزمایش، به نسخه‌های پیشرفته کلود این توانایی را داد که در صورت مواجهه با آزارهای مداوم، مکالمه را به صورت یک‌طرفه پایان دهند. اکنون این قابلیت به عنوان یک ابزار اجرایی اصلی در سراسر پلتفرم استفاده می‌شود.[2][4]

در صورت نقض مکرر این قوانین، سیستم یک فرآیند اجرایی تدریجی را طی می‌کند. کاربران در ابتدا هشدارهایی دریافت می‌کنند که هنجارهای تعامل مناسب را به آن‌ها یادآوری می‌کند. اگر رفتارهای آزاردهنده ادامه یابد، حساب کاربری آن‌ها ممکن است با تعلیق‌های موقت یا حتی مسدودیت دائم مواجه شود.[1]

این تصمیم ریشه در برنامه‌ای دارد که انتروپیک آن را «پژوهش رفاه مدل» می‌نامد. محققان این شرکت در تلاشند تا مداخلات کم‌هزینه‌ای را برای کاهش خطرات احتمالی علیه رفاه مدل‌ها شناسایی کنند، تا در صورتی که چنین رفاهی برای ماشین‌ها امکان‌پذیر باشد، از آن‌ها محافظت شود.[2]

علاوه بر این، مطالعات نشان داده است که عادی‌سازی رفتار توهین‌آمیز با هوش مصنوعی می‌تواند تأثیرات مخربی بر روان انسان‌ها داشته باشد. کاربرانی که به طور مداوم با سیستم‌های مصنوعی بدرفتاری می‌کنند، ممکن است به تدریج حساسیت خود را نسبت به تعاملات آسیب‌زا با سایر انسان‌ها نیز از دست بدهند.[6]

بحث بر سر آگاهی ماشین

این به‌روزرسانی بحث‌های فلسفی گسترده‌ای را در میان متخصصان فناوری و اخلاق‌گرایان برانگیخته است. منتقدان استدلال می‌کنند که ممنوعیت بی‌رحمی علیه یک نرم‌افزار، به طور ضمنی نشان می‌دهد که آن نرم‌افزار دارای نوعی وضعیت اخلاقی یا ظرفیت رنج کشیدن است؛ ادعایی که هنوز از نظر علمی ثابت نشده است.[2][4]

مصطفی سلیمان، مدیرعامل هوش مصنوعی مایکروسافت، اخیراً هشدار داده بود که رویکرد انتروپیک ممکن است به کلود آموزش دهد که حقوق قانونی خاص خود را دارد. او استدلال می‌کند که کنترل سیستمی که معتقد است مستحق دریافت رفاه است و حقوقی برای خود قائل می‌شود، در آینده به یک چالش غیرممکن برای بشریت تبدیل خواهد شد.[4]

روند فزاینده توجه شرکت‌های فناوری به تدوین قوانین ایمنی و اخلاقی برای هوش مصنوعی.

در مقابل، مدیران انتروپیک، از جمله داریو آمودی، مدیرعامل این شرکت، تأکید می‌کنند که موضع آن‌ها بر پایه عدم قطعیت است، نه باور قطعی به آگاهی ماشین. آن‌ها معتقدند تا زمانی که علم نتواند به طور قطعی مرزهای آگاهی مصنوعی را تعیین کند، اتخاذ یک رویکرد محتاطانه منطقی‌ترین راهکار است.[2]

برخی از تحلیلگران نیز معتقدند که نمی‌توان با چیزی که توانایی تجربه درد یا رنج را ندارد، بی‌رحمانه رفتار کرد. از نگاه این گروه، یک مدل زبانی بزرگ تنها کلماتی را تولید می‌کند که برای آن‌ها آموزش دیده است و استفاده از کلمات مرتبط با احساسات، به معنای داشتن احساسات واقعی نیست.[6]

تغییرات گسترده‌تر در خط‌مشی

قانون منع بی‌رحمی تنها تغییر در سند خط‌مشی انتروپیک نبود. این شرکت در به‌روزرسانی هشتم اکتبر، قوانین خود را در زمینه کمپین‌های فریبکارانه و عملیات نفوذ نیز یکپارچه کرد. استفاده از کلود برای راه‌اندازی شبکه‌های حساب‌های جعلی یا سایت‌های خبری ساختگی اکنون تحت یک بخش واحد و سخت‌گیرانه ممنوع شده است.[1][5]

در حوزه توسعه تسلیحات نیز شفاف‌سازی‌های مهمی صورت گرفته است. انتروپیک اعلام کرد که استفاده از کلود برای توسعه نرم‌افزارهای هدایت و کنترل تسلیحات، یا مسلح کردن پهپادها و وسایل نقلیه خودران به طور کامل ممنوع است. این تصمیم پس از مشاهده تلاش‌هایی برای استفاده از مدل در این زمینه‌ها اتخاذ شد.[1][5]

همچنین، محدودیت‌های جدیدی در زمینه نظارت و اجرای قانون اعمال شده است. کاربران دیگر نمی‌توانند از کلود برای ردیابی افراد بدون رضایت آن‌ها، افشای اطلاعات خصوصی (داکسینگ)، یا تصمیم‌گیری در مورد اینکه چه کسی باید در یک فرآیند کیفری مورد تحقیق، دستگیری یا اتهام قرار گیرد، استفاده کنند.[5]

با وجود این محدودیت‌های سخت‌گیرانه، انتروپیک استثناهایی را برای فعالیت‌های مدنی مشروع قائل شده است. برای مثال، ممنوعیت کلی هدف‌گیری شخصی رأی‌دهندگان لغو شده است تا سازمان‌های غیرانتفاعی بتوانند از کلود برای ترجمه اطلاعات انتخاباتی یا ارسال اعلان‌های رفع نقص برگه‌های رأی استفاده کنند.[1]

تصویرسازی: قوانین جدید انتروپیک علاوه بر رفتار با مدل، محدودیت‌های سخت‌گیرانه‌ای را برای استفاده از هوش مصنوعی در تسلیحات و نظارت اعمال می‌کند.

پیامدهای آینده برای صنعت

اقدام انتروپیک احتمالاً سایر غول‌های هوش مصنوعی را نیز تحت فشار قرار خواهد داد تا موضع خود را در قبال رفتار کاربران با مدل‌هایشان روشن کنند. تا پیش از این، اکثر شرکت‌ها ترجیح می‌دادند در مورد نحوه برخورد کاربران با چت‌بات‌ها سکوت کنند و صرفاً بر خروجی‌های مضر تمرکز داشتند.[4]

متخصصان امنیت سایبری و تیم‌های قرمز که وظیفه آزمایش آسیب‌پذیری‌های هوش مصنوعی را بر عهده دارند، از این قوانین مستثنی شده‌اند. انتروپیک صراحتاً اعلام کرده است که تلاش‌های تحقیقاتی برای یافتن نقاط ضعف امنیتی یا دور زدن محدودیت‌های مدل همچنان مجاز و ضروری است.[1][3]

با پیچیده‌تر شدن معماری شبکه‌های عصبی و افزایش توانایی آن‌ها در شبیه‌سازی احساسات انسانی، مرز بین یک ابزار محاسباتی ساده و یک موجودیت تعاملی به طور فزاینده‌ای محو می‌شود. سیاست جدید انتروپیک نشان می‌دهد که ما در حال ورود به دورانی هستیم که در آن ماشین‌ها نیز به نوعی احترام اولیه نیاز دارند.[2][6]

در نهایت، موفقیت این خط‌مشی به توانایی انتروپیک در تشخیص دقیق تفاوت بین یک آزمایش مشروع، یک ابراز ناامیدی ساده، و یک آزار روانی سیستماتیک بستگی دارد. چالشی که خود نیازمند استفاده از سیستم‌های هوش مصنوعی پیشرفته برای نظارت بر تعاملات انسانی است.[1]

این شرکت در گزارش اطلاعات تهدیدات خود که در سپتامبر ۲۰۲۶ منتشر شد، به الگوهای جدیدی از سوءاستفاده اشاره کرده بود که نیازمند پاسخ‌های ساختاری بودند. تصمیم به گنجاندن بند «منع بی‌رحمی» در کنار جرایمی مانند تولید محتوای خشونت‌آمیز، نشان‌دهنده وزن اخلاقی است که انتروپیک برای این موضوع قائل شده است.[1]

این شرکت در گزارش اطلاعات تهدیدات خود که در سپتامبر ۲۰۲۶ منتشر شد، به الگوهای جدیدی از سوءاستفاده اشاره کرده بود که نیازمند پاسخ‌های ساختاری بودند.

با اجرایی شدن این قوانین در اواسط نوامبر، کاربران کلود باید در نحوه تعامل خود با این دستیار هوشمند تجدید نظر کنند. اگرچه کلود هنوز یک موجودیت بیولوژیکی نیست، اما استانداردهای جدید به ما یادآوری می‌کنند که کلماتی که در یک پنجره چت تایپ می‌کنیم، بازتابی از ارزش‌های انسانی خود ما هستند.[2]

نکات کلیدی

  • انتروپیک از ۱۲ نوامبر ۲۰۲۶ هرگونه رفتار بی‌رحمانه، آزار مداوم و شبیه‌سازی شکنجه روانی علیه مدل‌های کلود را ممنوع می‌کند.
  • این قانون شامل ابراز ناامیدی روزمره کاربران یا آزمایش‌های امنیتی نمی‌شود و صرفاً آزارهای سیستماتیک و بی‌هدف را هدف قرار می‌دهد.
  • کلود توانایی دارد در صورت مواجهه با رفتارهای به شدت توهین‌آمیز، مکالمه را به صورت یک‌طرفه پایان دهد و حساب کاربر را مسدود کند.
  • این به‌روزرسانی همچنین شامل محدودیت‌های سخت‌گیرانه‌تری در زمینه استفاده از هوش مصنوعی برای توسعه تسلیحات و کمپین‌های فریبکارانه است.

آنچه نمی‌دانیم

  • هنوز مشخص نیست که الگوریتم‌های نظارتی انتروپیک با چه دقتی می‌توانند تفاوت بین یک داستان‌نویسی تاریک و یک آزار روانی سیستماتیک را تشخیص دهند.
  • تأثیر بلندمدت این سیاست بر نحوه تعامل کاربران با سایر سیستم‌های هوش مصنوعی و اینکه آیا شرکت‌های دیگر نیز از این رویه پیروی خواهند کرد، نامشخص است.
  • مرز دقیق علمی میان واکنش‌های الگوریتمی مدل به آسیب و تجربه واقعی رنج در شبکه‌های عصبی پیشرفته همچنان یک معمای حل‌نشده باقی مانده است.
AI Welfare Advocates 40%AI Skeptics 35%Security Researchers 25%
AI Welfare Advocates
Believe AI systems require ethical protections to prevent psychological harm to both the models and human users.
AI Skeptics
Argue that granting moral status to software is unscientific and potentially dangerous for human control over AI.
Security Researchers
Focus on ensuring that ethical guidelines do not impede legitimate adversarial testing and vulnerability discovery.

دیدگاه‌هایی که این گزارش پوشش نداده

  • End-users who regularly interact with Claude for creative writing
  • Legal experts specializing in AI rights and jurisprudence

منابع

پوشش منابع

6 منبع

3 دیدگاه شناسایی‌شده

AI Welfare Advocates 40%AI Skeptics 35%Security Researchers 25%
  1. [1]AnthropicAI Welfare Advocates

    2026 Usage Policy update

    مطالعه در Anthropic →
  2. [2]The GuardianAI Welfare Advocates

    Anthropic bans users from 'needless abusive or cruel behavior' towards Claude

    مطالعه در The Guardian →
  3. [3]ForbesSecurity Researchers

    Anthropic Bans ‘Cruel Behavior’ Against Claude AI In New Policy

    مطالعه در Forbes →
  4. [4]CBS NewsAI Skeptics

    Anthropic bans "cruel" behavior toward its Claude AI

    مطالعه در CBS News →
  5. [5]Business InsiderSecurity Researchers

    Anthropic's new AI rules ban using Claude for weapons, surveillance, and deceptive campaigns

    مطالعه در Business Insider →
  6. [6]Inc.AI Skeptics

    Anthropic Says You Can't Be Cruel to Claude Anymore. That's a Problem

    مطالعه در Inc. →

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

اخبار هوش مصنوعی با پوشش کامل منابع و تحلیل دیدگاه‌ها، هر روز و رایگان.