رفتن به محتوای اصلی
توضیح کوهستانایمنی هوش مصنوعیتوضیح و تشریح۱۶ تیر ۱۴۰۵، ۷:۲۵· 6 دقیقه مطالعه· در هوش مصنوعی

اوپن‌ای‌آی عرضه GPT-5.6 را به درخواست دولت آمریکا به تأخیر انداخت؛ نشانه‌ای از آغاز دوران جدید نظارت فدرال

تأخیر بی‌سابقه در عرضه جدیدترین مدل پیشگام اوپن‌ای‌آی، نشان‌دهنده یک تحول تاریخی از خودتنظیمی داوطلبانه صنعت به نظارت فعال فدرال بر هوش مصنوعی است. در اینجا نحوه عملکرد فرآیند جدید بررسی دولت آمریکا توضیح داده شده است.

به قلم الوین شادمهر

تنظیم‌کنندگان ایمنی فدرال 35%توسعه‌دهندگان هوش مصنوعی پیشگام 30%سیاست‌گذاران شاخه اجرایی 20%تحلیلگران مستقل صنعت 15%
تنظیم‌کنندگان ایمنی فدرال
استدلال می‌کنند که ارزیابی مستقل و تحت رهبری دولت برای کاهش خطرات فاجعه‌بار قبل از استقرار ضروری است.
توسعه‌دهندگان هوش مصنوعی پیشگام
از چارچوب‌های ایمنی مشارکتی حمایت می‌کنند اما بر لزوم ایجاد تعادل بین آزمایش دقیق و نوآوری سریع تأکید دارند.
سیاست‌گذاران شاخه اجرایی
هوش مصنوعی را از منظر امنیت ملی می‌بینند و از اختیارات اجرایی برای نظارت بر قابلیت‌های استفاده دوگانه استفاده می‌کنند.
تحلیلگران مستقل صنعت
بر تنش بین موانع ایمنی ضروری و خطر تسخیر نظارتی که می‌تواند رقابت متن‌باز را خفه کند، تأکید می‌کنند.

چرا مهم است

این تأخیر پایان قطعی دوران خودتنظیمی صنعت فناوری را رقم می‌زند. برای اولین بار، دولت فدرال به طور فعال در برنامه زمانی عرضه هوش مصنوعی پیشگام مداخله می‌کند و سابقه‌ای را ایجاد می‌کند که نحوه بررسی تمام فناوری‌های تحول‌آفرین آینده قبل از رسیدن به دست عموم را تعیین خواهد کرد.

برای اولین بار در تاریخ کوتاه و پرشتاب هوش مصنوعی مولد، یک آزمایشگاه پیشرو عرضه مهمی را به درخواست مستقیم دولت فدرال متوقف کرده است. تصمیم اوپن‌ای‌آی برای به تأخیر انداختن عرضه GPT-5.6 تا زمان بررسی بیشتر توسط مؤسسه ایمنی هوش مصنوعی ایالات متحده (USAISI) یک نقطه عطف برای صنعت فناوری محسوب می‌شود.[1][2]

این تأخیر یک اقدام تنبیهی نیست، بلکه اولین اجرای عمومی یک خط لوله ارزیابی جدید و بسیار مهم است. این نشان می‌دهد که دوران «سریع حرکت کن و خرابکاری کن» برای مدل‌های هوش مصنوعی پیشگام قطعاً به پایان رسیده است. در عوض، ایالات متحده بی‌سروصدا یک فرآیند بررسی فدرال بالفعل برای قدرتمندترین شبکه‌های عصبی جهان ایجاد کرده است.[1]

اما این بررسی دقیقاً چگونه کار می‌کند؟ برخلاف صنعت داروسازی که سازمان غذا و داروی آمریکا (FDA) را دارد، یا بخش هوانوردی که به سازمان هوانوردی فدرال (FAA) متکی است، صنعت هوش مصنوعی یک نهاد نظارتی قانونی اختصاصی ندارد. رژیم نظارتی فعلی مجموعه‌ای پیچیده از دستورات اجرایی، توافق‌نامه‌های داوطلبانه و دستورالعمل‌های امنیت ملی است.

اساس این دوران جدید، فرمان اجرایی ۱۴۱۱۰ است که در اکتبر ۲۰۲۳ امضا شد. این فرمان قانون تولید دفاعی (Defense Production Act) – قانونی مربوط به دوران جنگ سرد که برای تضمین در دسترس بودن مواد حیاتی طراحی شده بود – را برای الزام توسعه‌دهندگان قدرتمندترین سیستم‌های هوش مصنوعی به اشتراک‌گذاری نتایج آزمایش‌های ایمنی خود با دولت آمریکا، به کار گرفت.

محرک این گزارش‌دهی اجباری، قدرت محاسباتی خام است. هر مدل هوش مصنوعی که با استفاده از بیش از ۱۰ به توان ۲۶ عملیات ممیز شناور (FLOPs) آموزش دیده باشد، به طور خودکار تحت نظارت فدرال قرار می‌گیرد. برای درک بهتر، مدل‌هایی در این مقیاس نیاز به ده‌ها هزار واحد پردازش گرافیکی (GPU) تخصصی دارند که ماه‌ها به طور مداوم کار کنند و صدها میلیون دلار سرمایه‌گذاری را نشان می‌دهند.[1]

هنگامی که شرکتی مانند اوپن‌ای‌آی به این آستانه نزدیک می‌شود، موظف است به وزارت بازرگانی اطلاع دهد. این اطلاع‌رسانی فاز ارزیابی مشترک، اما دقیق، قبل از استقرار را آغاز می‌کند که توسط مؤسسه USAISI رهبری می‌شود؛ این مؤسسه در داخل مؤسسه ملی استانداردها و فناوری (NIST) قرار دارد.[2][5]

مأموریت USAISI پیشبرد علم ایمنی هوش مصنوعی از طریق توسعه آزمون‌ها و معیارهای مبتنی بر شواهد تجربی است. از طریق تفاهم‌نامه‌های امضا شده با آزمایشگاه‌های برتر، این مؤسسه دسترسی زودهنگام و قبل از انتشار به مدل‌ها پیدا می‌کند. این امر به دانشمندان دولتی اجازه می‌دهد تا سیستم‌ها را در یک محیط امن، قبل از اینکه در معرض عموم قرار گیرند، بررسی کنند.[2]

فرآیند بررسی فدرال به شدت بر «خطرات فاجعه‌بار» تمرکز دارد. ارزیابان در درجه اول نگران این نیستند که آیا یک مدل گهگاه یک تاریخ تاریخی را اشتباه می‌گوید یا یک رزومه مغرضانه تولید می‌کند. در عوض، آنها به دنبال قابلیت‌های استفاده دوگانه هستند که می‌تواند امنیت ملی یا ایمنی عمومی را تهدید کند.[1][2]

ارزیابان در درجه اول نگران این نیستند که آیا یک مدل گهگاه یک تاریخ تاریخی را اشتباه می‌گوید یا یک رزومه مغرضانه تولید می‌کند.

بردارهای تهدید اصلی شامل خطرات شیمیایی، بیولوژیکی، رادیولوژیکی و هسته‌ای (CBRN) است. تیم‌های قرمز دولتی – هکرها و دانشمندان متخصصی که وظیفه دارند سیستم را از کار بیندازند – آزمایش می‌کنند که آیا هوش مصنوعی می‌تواند به یک عامل مخرب در سنتز یک پاتوژن جدید یا طراحی یک سلاح کمک کند.[2]

امنیت سایبری یکی دیگر از ستون‌های حیاتی ارزیابی است. ارزیابان آزمایش می‌کنند که آیا مدل می‌تواند به طور مستقل آسیب‌پذیری‌های روز صفر (zero-day) را در زیرساخت‌های حیاتی کشف و بهره‌برداری کند. آنها همچنین امنیت خود مدل را ارزیابی می‌کنند تا اطمینان حاصل شود که وزن‌های آن – پارامترهای ریاضی اصلی که هوش مصنوعی را تعریف می‌کنند – به راحتی توسط دشمنان خارجی به سرقت نرود.

در نهایت، فرآیند بررسی، تکثیر و انطباق خودکار را بررسی می‌کند. این شامل آزمایش این است که آیا سیستم هوش مصنوعی می‌تواند کد خود را بنویسد، منابع محاسباتی را به دست آورد و بدون دخالت انسان خود را در سراسر اینترنت منتشر کند – سناریویی که محققان ایمنی مدت‌هاست هشدار داده‌اند که می‌تواند منجر به نتایج غیرقابل کنترل شود.[1][3]

چارچوب آمادگی خود اوپن‌ای‌آی با این ارزیابی‌های فدرال همپوشانی دارد. دستورالعمل‌های داخلی این شرکت خطرات را در سطوحی مانند «بالا» و «بحرانی» دسته‌بندی می‌کند. تحت تعهدات داوطلبانه خود، اوپن‌ای‌آی متعهد شده است که مدل‌هایی را که از آستانه خطر «بالا» عبور می‌کنند، مستقر نکند، مگر اینکه اقدامات کاهشی خاص و قابل اندازه‌گیری در نظر گرفته شده باشد.[3]

تأخیر GPT-5.6 نشان می‌دهد که یا معیارهای داخلی اوپن‌ای‌آی یا ارزیابی‌های مستقل USAISI قابلیتی را علامت‌گذاری کرده‌اند که نیاز به کاهش بیشتر خطر داشته است. این اصطکاک مشارکتی دقیقاً همان چیزی است که مجمع مدل پیشگام (Frontier Model Forum) – یک نهاد صنعتی که توسط اوپن‌ای‌آی، آنتروپیک، گوگل و مایکروسافت تشکیل شده است – هنگام حمایت از استانداردهای ایمنی مشترک، پیش‌بینی کرده بود.[4]

با این حال، تغییر از تعهدات داوطلبانه به تأخیرهای درخواستی دولت، یک پویایی قدرت ظریف را برجسته می‌کند. USAISI در حال حاضر اختیار قانونی برای ممنوعیت کامل یک مدل را ندارد. اهرم فشار آن متکی بر ترکیبی از قانون تولید دفاعی، تهدید کنترل‌های صادراتی، و ریسک عظیم روابط عمومی است که یک شرکت در صورت سرپیچی از توصیه ایمنی فدرال با آن مواجه خواهد شد.[1]

این پویایی بحث‌های شدیدی را در جامعه فناوری برانگیخته است. طرفداران استدلال می‌کنند که بررسی فدرال یک محافظ ضروری در برابر خطرات وجودی است و تضمین می‌کند که انگیزه‌های سود بر ایمنی عمومی غلبه نکنند. آنها USAISI را به عنوان یک داور حیاتی و بی‌طرف می‌بینند که قادر به استانداردسازی ارزیابی‌ها در یک صنعت به شدت رقابتی است.[1][2]

در مقابل، طرفداران متن‌باز و توسعه‌دهندگان کوچک‌تر نگران تسخیر نظارتی هستند. آنها استدلال می‌کنند که آستانه‌های محاسباتی و فرآیندهای بررسی مبهم، یک مانع غیرقابل عبور برای شرکت‌های بزرگ ایجاد می‌کند. اگر فقط ثروتمندترین شرکت‌ها بتوانند از عهده هزینه‌های انطباق برآیند و در بوروکراسی فدرال حرکت کنند، اکوسیستم هوش مصنوعی می‌تواند به طور دائمی متمرکز شود.[1]

در سطح جهانی، رویکرد آمریکا با قانون هوش مصنوعی اتحادیه اروپا متفاوت است، که الزامات سختگیرانه و الزام‌آور قانونی را بر اساس موارد استفاده خاص هوش مصنوعی، همراه با ردیف‌های ریسک سیستمی برای مدل‌های بنیادی، اعمال می‌کند. استراتژی آمریکا چابک‌تر باقی می‌ماند اما به شدت متکی بر اختیارات شاخه اجرایی است، که می‌تواند با تغییر دولت‌های سیاسی دستخوش تغییر شود.

تأخیر GPT-5.6 یک مانع برای هوش مصنوعی نیست؛ بلکه نصب یک چراغ راهنمایی در یک تقاطع است که قبلاً بدون مقررات بود. همانطور که مدل‌ها به مقیاس خود ادامه می‌دهند، عبور از آستانه ۱۰ به توان ۲۶ فلوپس رایج‌تر خواهد شد. سابقه امروز تضمین می‌کند که قدرتمندترین فناوری‌های قرن ۲۱ قبل از تغییر شکل جهان، با بررسی دقیق و مستقل مواجه خواهند شد.[1][2]

نکات کلیدی

  1. اوپن‌ای‌آی عرضه GPT-5.6 را به درخواست مؤسسه ایمنی هوش مصنوعی آمریکا به تأخیر انداخت.
  2. این تأخیر نشان‌دهنده تغییر از خودتنظیمی داوطلبانه صنعت به نظارت فعال فدرال است.
  3. مدل‌هایی که با بیش از ۱۰ به توان ۲۶ عملیات فلوپس آموزش دیده‌اند، به طور خودکار الزامات گزارش‌دهی فدرال را فعال می‌کنند.
  4. ارزیابان بر خطرات فاجعه‌بار، از جمله سنتز سلاح‌های بیولوژیکی و حملات سایبری، تمرکز می‌کنند.
  5. دولت برای اجرای انطباق، بدون داشتن اختیار قانونی ممنوعیت، به قانون تولید دفاعی متکی است.

اصطلاحات کلیدی

هوش مصنوعی پیشگام (Frontier AI)
مدل‌های یادگیری ماشینی در مقیاس بزرگ و بسیار توانمند که از قابلیت‌های سیستم‌های موجود فراتر رفته و می‌توانند طیف گسترده‌ای از وظایف را انجام دهند.
تیم قرمز (Red Teaming)
یک روش ارزیابی امنیتی که در آن کارشناسان فعالانه تلاش می‌کنند تا یک سیستم هوش مصنوعی را هک، دستکاری یا از کار بیندازند تا آسیب‌پذیری‌ها را قبل از انتشار کشف کنند.
فلوپس (FLOPs)
عملیات ممیز شناور، معیاری برای قدرت محاسباتی که برای اندازه‌گیری مقیاس عظیم سخت‌افزار مورد نیاز برای آموزش مدل‌های پیشرفته هوش مصنوعی استفاده می‌شود.
فناوری با کاربرد دوگانه
فناوری‌ای که می‌تواند هم برای اهداف صلح‌آمیز و تجاری و هم برای کاربردهای نظامی یا مخرب استفاده شود.

منابع

پوشش منابع

5 منبع

4 دیدگاه شناسایی‌شده

تنظیم‌کنندگان ایمنی فدرال 35%توسعه‌دهندگان هوش مصنوعی پیشگام 30%سیاست‌گذاران شاخه اجرایی 20%تحلیلگران مستقل صنعت 15%
  1. [1]تیم سردبیری کوهستانتحلیلگران مستقل صنعت

    تحلیل تیم سردبیری کوهستان

    مطالعه در تیم سردبیری کوهستان
  2. [2]National Institute of Standards and Technologyتنظیم‌کنندگان ایمنی فدرال

    U.S. Artificial Intelligence Safety Institute

    مطالعه در National Institute of Standards and Technology
  3. [3]OpenAIتوسعه‌دهندگان هوش مصنوعی پیشگام

    Preparedness Framework

    مطالعه در OpenAI
  4. [4]Frontier Model Forumتوسعه‌دهندگان هوش مصنوعی پیشگام

    Advancing frontier AI safety and security

    مطالعه در Frontier Model Forum
  5. [5]US Department of Commerceتنظیم‌کنندگان ایمنی فدرال

    Commerce Department Releases Strategic Vision on AI Safety for the U.S. Artificial Intelligence Safety Institute

    مطالعه در US Department of Commerce

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت هوش مصنوعی اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.