دولت آمریکا پس از مداخلات پیش از انتشار در آزمایشگاههای برتر، استانداردهای داوطلبانه هوش مصنوعی را تسریع میکند
موسسه ایمنی هوش مصنوعی آمریکا (USAISI) پس از همکاری مستقیم با اوپنایآی و آنتروپیک برای ارزیابی جدیدترین مدلهای پیشروی آنها، در حال رسمی کردن چارچوب آزمایش پیش از استقرار خود است. هدف از این دستورالعملهای تسریعشده، استانداردسازی نحوه ارزیابی خطرات فاجعهبار توسط دولت، پیش از رسیدن سیستمهای پیشرفته هوش مصنوعی به دست عموم است.
به قلم الوین شادمهر
این خبر را به اشتراک بگذارید
- توسعهدهندگان هوش مصنوعی پیشرو
- آزمایشگاههای بزرگ که از آزمایشهای دولتی برای ایجاد اعتماد عمومی و جلوگیری از مقررات قانونی سختگیرانه حمایت میکنند.
- نهاد امنیت ملی
- سیاستگذاران و محققانی که این چارچوب را به عنوان اولین گام ضروری برای جلوگیری از گسترش تهدیدات سایبری و CBRN مبتنی بر هوش مصنوعی میبینند.
- حامیان متنباز
- توسعهدهندگانی که میترسند این استانداردها به یک مانع نظارتی تبدیل شوند که نوآوری غیرمتمرکز را خفه کرده و آزمایشگاههای کوچکتر را مجازات کند.
چرا مهم است
این تغییر، عملاً یک ایست بازرسی ایمنی ملی برای قدرتمندترین سیستمهای هوش مصنوعی جهان ایجاد میکند. دولت با استانداردسازی نحوه آزمایش مدلها برای خطرات بیولوژیکی و سایبری پیش از انتشار، چارچوبی قابل پیشبینی ایجاد میکند که بر همه چیز، از استقرار نرمافزارهای سازمانی گرفته تا امنیت ملی، تأثیر میگذارد.
شش ماه گذشته، انتشار قدرتمندترین مدلهای هوش مصنوعی جهان، بیسروصدا یک شرکتکننده اعلامنشده را درگیر کرده است: دولت ایالات متحده. پس از مداخلات موقت برای ارزیابی جدیدترین مدلهای پیشرو از اوپنایآی و آنتروپیک، تنها چند هفته قبل از برنامهریزی برای عرضه عمومی، اکنون وزارت بازرگانی در حال رسمی کردن این فرآیند است.[1][2]
موسسه ایمنی هوش مصنوعی آمریکا (USAISI)، که در موسسه ملی استانداردها و فناوری (NIST) مستقر است، یک جدول زمانی تسریعشده برای «استانداردهای داوطلبانه آزمایش پیش از استقرار» خود اعلام کرد. این چارچوب یک بازه زمانی استاندارد ۲۱ روزه را برای محققان دولتی تعیین میکند تا مدلهای پیشرفته را قبل از استقرار برای مصرفکنندگان یا مشتریان سازمانی، مورد ارزیابی آسیبپذیری (red-team) قرار دهند.[3]
این اقدام نشاندهنده بلوغ قابل توجهی در نحوه برخورد واشنگتن با هوش مصنوعی است. دولت به جای تکیه بر تماسهای اضطراری یا توافقات غیررسمی با مدیران اجرایی فناوری، در حال ایجاد یک سازوکار قابل پیشبینی و نهادینهشده است تا قابلیتهای فاجعهبار را قبل از گسترش در سراسر اینترنت شناسایی کند.
کاتالیزور این تسریع، مجموعهای از ارزیابیهای پرمخاطره اخیر بود. زمانی که اوپنایآی و آنتروپیک هر دو برای راهاندازی سیستمهای نسل بعدی خود در اوایل سال جاری آماده میشدند، به محققان USAISI دسترسی بیسابقهای به وزنهای مدل (model weights) پیش از انتشار داده شد. دولت میخواست مطمئن شود که این سیستمها نمیتوانند به راحتی برای ایجاد آسیبهای گسترده مورد سوءاستفاده قرار گیرند.[2][5]
در طول این مداخلات، ارزیابهای دولتی به دنبال مسائل روزمره مانند تولید متن مغرضانه یا نقض حق چاپ نبودند. در عوض، آنها منحصراً بر تهدیدات امنیت ملی با پیامدهای بالا تمرکز کردند و تحت یک دستور کار میکردند تا از استقرار سیستمهایی که میتوانند اساساً چشمانداز تهدید جهانی را تغییر دهند، جلوگیری کنند.
پروتکلهای آزمایش بر چهار بردار اصلی خطر فاجعهبار تمرکز دارند: تسلیحاتی شدن شیمیایی، بیولوژیکی، رادیولوژیکی و هستهای (CBRN)؛ قابلیتهای تهاجمی سایبری خودکار؛ تکثیر خودکار عاملمحور (agentic self-proliferation)؛ و توانایی دور زدن حفاظهای ایمنی موجود بدون دخالت انسان.
برای انجام این آزمایشها، محققان دولتی از تأسیسات تخصصی و جدا از شبکه (air-gapped) استفاده میکنند. آنها از «حملات تقطیر» (distillation attacks)، مجموعههای خودکار دور زدن محدودیتها (jailbreaking suites) و محیطهای شبیهسازیشده پرمخاطره استفاده میکنند تا ببینند آیا میتوان مدلها را وادار کرد که دستورالعملهای عملی برای سنتز عوامل بیماریزا یا بهرهبرداری از آسیبپذیریهای نرمافزاری روز صفر (zero-day) ارائه دهند یا خیر.[3]
برای انجام این آزمایشها، محققان دولتی از تأسیسات تخصصی و جدا از شبکه (air-gapped) استفاده میکنند.
اگرچه استانداردهای جدید رسماً «داوطلبانه» نامیده میشوند، تحلیلگران صنعت خاطرنشان میکنند که آنها عملاً به عنوان یک رژیم نظارتی برای رده بالای توسعهدهندگان هوش مصنوعی عمل میکنند. آستانه این بررسیها به میزان خالص قدرت محاسباتی مورد استفاده برای آموزش یک مدل گره خورده است – که در حال حاضر روی ۱۰ به توان ۲۶ عملیات ممیز شناور (FLOPs) تنظیم شده است، سطحی که تنها تعداد انگشتشماری از شرکتها میتوانند به آن دست یابند.[5]
برای شرکتهایی که در این مرز فعالیت میکنند، امتناع از شرکت در چارچوب داوطلبانه، خطرات ضمنی عظیمی را به همراه دارد. دولت آمریکا صادرات نیمهرساناهای پیشرفته مورد نیاز برای آموزش این مدلها را کنترل میکند و آژانسهای فدرال به طور فزایندهای قراردادهای سودآور ابری و نرمافزاری را به انطباق با USAISI مرتبط میکنند.[5]
هم اوپنایآی و هم آنتروپیک علناً از استانداردهای تسریعشده استقبال کردهاند. این شرکتها در بیانیههای هماهنگ تأکید کردند که ارزیابیهای ایمنی مستقل و با حمایت دولت برای حفظ اعتماد عمومی و اطمینان از اینکه مسابقه برای هوش عمومی مصنوعی (AGI) امنیت ملی را به خطر نمیاندازد، حیاتی است.[1]
با این حال، رسمی شدن این استانداردها بحثهای شدیدی را در اکوسیستم فناوری گستردهتر برانگیخته است. حامیان متنباز و توسعهدهندگان کوچکتر استدلال میکنند که این چارچوب، در حالی که در حال حاضر مدلهای پیشرو عظیم را هدف قرار میدهد، سابقهای را ایجاد میکند که میتواند در نهایت به مجازات تحقیقات هوش مصنوعی غیرمتمرکز منجر شود.[4]
این منتقدان خاطرنشان میکنند که هزینه و زیرساخت مورد نیاز برای تسهیل فرآیند ۲۱ روزه ارزیابی آسیبپذیری دولتی برای یک غول فناوری تریلیون دلاری ناچیز است، اما برای یک آزمایشگاه دانشگاهی یا یک گروه متنباز میتواند ویرانگر باشد. آنها میترسند که استانداردهای داوطلبانه به یک مانع نظارتی سخت تبدیل شوند و از شرکتهای موجود در برابر اختلال محافظت کنند.[4]
رویکرد آمریکا در تضاد شدید با استراتژی اتحادیه اروپا قرار دارد. در حالی که قانون هوش مصنوعی اتحادیه اروپا بر مقررات قانونی جامع با مجازاتهای حقوقی سخت برای عدم انطباق تکیه دارد، واشنگتن بر «همکاری چابک» شرطبندی میکند. چارچوب USAISI طراحی شده است تا به سرعت در کنار فناوری تکامل یابد و از تعاریف سفت و سختی که اغلب قوانین فناوری را قبل از تصویب منسوخ میکنند، اجتناب نماید.[2]
این انعطافپذیری حیاتی است زیرا علم ارزیابی هوش مصنوعی هنوز در مراحل اولیه خود قرار دارد. محققان اغلب راههای جدیدی برای دور زدن فیلترهای ایمنی مدل کشف میکنند، به این معنی که آزمایشی که ثابت میکند یک مدل امروز ایمن است، ممکن است فردا با توسعه تکنیکهای جدید دور زدن محدودیتها (jailbreaking) کاملاً ناکافی باشد.[3]
دولت با نهادینهسازی فرآیند بررسی، در حال ایجاد یک مخزن متمرکز از دانش در مورد قابلیتهای مدلهای پیشرو نیز هست. این دادهها به سیاستگذاران اجازه میدهد تا پیشرفت کلی صنعت را ردیابی کنند و پیشبینی نمایند که هوش مصنوعی چه زمانی ممکن است از آستانههای حیاتی عبور کند، مانند توانایی انجام تحقیقات علمی به صورت خودکار یا نوشتن بدافزار در سطح تولید.
در نهایت، تسریع این استانداردهای داوطلبانه، پایان دوران استقرار بیقید و شرط هوش مصنوعی را نشان میدهد. همانطور که هوش مصنوعی از یک نوآوری مصرفکننده به یک ستون اساسی زیرساخت ملی تبدیل میشود، دست دادن بین سیلیکون ولی و واشنگتن در حال رسمی شدن است و تضمین میکند که قدرتمندترین سیستمهای روی زمین دیگر کاملاً در تاریکی منتشر نمیشوند.[1][5]
نکات کلیدی
- موسسه ایمنی هوش مصنوعی آمریکا در حال تسریع استانداردهای داوطلبانه آزمایش پیش از استقرار برای مدلهای پیشرو هوش مصنوعی است.
- این اقدام به دنبال مداخلات موفق و اعلامنشده دولت پیش از انتشار اخیر مدلهای اوپنایآی و آنتروپیک صورت میگیرد.
- ارزیابیها منحصراً بر خطرات فاجعهبار، از جمله تسلیحاتی شدن بیولوژیکی و حملات سایبری خودکار، تمرکز دارند.
- اگرچه این استانداردها داوطلبانه هستند، اما به دلیل اهرم فشار دولت بر محاسبات و قراردادها، عملاً به عنوان یک الزام عمل میکنند.
- حامیان متنباز نگرانند که این چارچوب در نهایت برای خفه کردن توسعه غیرمتمرکز هوش مصنوعی استفاده شود.
اصطلاحات کلیدی
- تیم قرمز (Red-teaming)
- یک رویه امنیت سایبری که در آن ارزیابها فعالانه تلاش میکنند دفاع یک سیستم را بشکنند تا آسیبپذیریها را قبل از استقرار آن پیدا کنند.
- مدل پیشرو (Frontier Model)
- پیشرفتهترین و بسیار توانمندترین سیستمهای هوش مصنوعی که مرزهای فناوری فعلی را جابجا میکنند و برای آموزش به منابع محاسباتی عظیمی نیاز دارند.
- فلاپس (FLOPs)
- عملیات ممیز شناور؛ معیاری برای قدرت محاسباتی که برای تعیین مقیاس و پتانسیل یک مدل هوش مصنوعی استفاده میشود.
- جدا از شبکه (Air-gapped)
- یک اقدام امنیتی که در آن یک کامپیوتر یا شبکه به صورت فیزیکی از اینترنت و سایر شبکههای ناامن جدا میشود تا از نشت داده یا هک خارجی جلوگیری شود.
منابع
[1]Reutersتوسعهدهندگان هوش مصنوعی پیشروUS AI Safety Institute accelerates voluntary testing standards after OpenAI, Anthropic reviews
مطالعه در Reuters →
[2]Bloombergنهاد امنیت ملیWhite House Formalizes Pre-Release AI Model Checks Following Frontier Interventions
مطالعه در Bloomberg →
[3]Wiredنهاد امنیت ملیCan Cursor Remain a Platform for OpenAI and Anthropic’s Models Inside SpaceX?
مطالعه در Wired →
[4]TechCrunchحامیان متنبازOpenAI launches new initiative to help find and patch open-source bugs
مطالعه در TechCrunch →
[5]Financial Timesنهاد امنیت ملیWashington tightens grip on AI releases with 'voluntary' standards that feel mandatory
مطالعه در Financial Times →
نظرات
هر زاویه. هر روز.
دریافت هوش مصنوعی اخبار همراه با پوشش کامل منابع و تحلیل دیدگاهها، مستقیم در صندوق ورودی شما.


