مسدودسازی درخواستهای اکسپلویت توسط OpenAI پس از کشف خودکار آسیبپذیریهای روز صفر توسط GPT-6 Astra
شرکت OpenAI پس از آنکه مدل GPT-6 Astra در ارزیابی ExploitBench امتیاز ۱۰۰٪ را کسب کرد و توانایی خود را در کشف و نوشتن مستقل حملات سایبری روز صفر نشان داد، دسترسی به این مدل جدید را محدود کرد.
به قلم الوین شادمهر
این خبر را به اشتراک بگذارید
شرکت OpenAI قابلیت تولید کدهای اکسپلویت اثبات مفهوم (PoC) را در مدل تازهنفس خود، یعنی GPT-6 Astra، غیرفعال کرده است. این تصمیم پس از آن اتخاذ شد که ارزیابیهای داخلی نشان داد این سیستم میتواند بهطور خودکار آسیبپذیریهای روز صفر را کشف کرده و آنها را به سلاح تبدیل کند. این محدودیت که در تمامی سطوح API سازمانی و توسعهدهندگان اعمال شده، واکنشی است به کسب امتیاز کامل ۱۰۰٪ توسط این مدل در چارچوب استاندارد صنعتی ExploitBench.[1][2]
عبور Astra از این مرز، نشاندهنده یک تغییر مکانیکی در نحوه تعامل هوش مصنوعی با امنیت نرمافزار است. مدلهای پیشین برای طی کردن فرآیند کشف آسیبپذیری به هدایت اپراتورهای انسانی نیاز داشتند و صرفاً به عنوان ابزارهای تکمیل خودکار پیشرفته برای پژوهشگران امنیتی عمل میکردند. اما در مقابل، اگر یک پایگاه کد هدف به Astra داده شود، این مدل میتواند بهطور مستقل معماری آن را نقشهبرداری کند، نقصهای جدید در تخریب حافظه را تشخیص دهد و کدهای کاربردی لازم برای اکسپلویت آنها را بدون هیچگونه دخالت انسان بنویسد.[3][5]
شرکت NeuralTrust AI در تاریخ ۴ سپتامبر طی گزارشی به مدیران ارشد امنیت اطلاعات (CISO) نوشت: «این همان مرزی است که از سال ۲۰۲۴ انتظار عبورش را میکشیدیم. مدل Astra صرفاً در سطح تئوری توضیح نمیدهد که سرریز بافر چگونه ممکن است کار کند؛ بلکه چندین آسیبپذیری مجزا را به یکدیگر متصل میکند تا بهطور مستقل به اجرای کد از راه دور (RCE) دست یابد.»[4]
کسب امتیاز ۱۰۰٪ در ExploitBench که برای نخستین بار در تاریخ ۱ سپتامبر توسط The Hacker News گزارش شد، پروتکلهای ایمنی داخلی OpenAI را فعال کرد. چارچوب ExploitBench توانایی یک مدل را در پیمایش ۵۰ محیط نرمافزاری بسیار پیچیده و استخراج پرچمها از طریق اکسپلویت آسیبپذیریهای مستندنشده میسنجد. پیش از Astra، بالاترین امتیاز ثبتشده در این بنچمارک ۳۴٪ بود که در اوایل سال ۲۰۲۶ توسط یک مدل تخصصی تست نفوذ با ۷۰ میلیارد پارامتر به دست آمده بود.[2]
در پاسخ به این جهش قابلیتی، OpenAI سند نمای کلی ایمنی خود را برای GPT-6 Astra بهروزرسانی کرد و جزئیات محدودیتهای جدید را شرح داد. این شرکت اکنون یک مسدودکننده سختگیرانه روی هرگونه پرامپتی که درخواست تولید کد اکسپلویت عملیاتی داشته باشد اعمال کرده است؛ حتی برای کاربرانی که سختگیرانهترین فرآیندهای تایید سازمانی را گذرانده و دارای مجوزهای تجاری هستند.[1][6]
شرکت OpenAI در سند فنی خود اعلام کرد: «ما قابلیتهای سایبری خودکار Astra را در دسته ریسکهای بحرانی طبقهبندی میکنیم. اگرچه این مدل همچنان برای تحلیلهای تدافعی و تولید پچهای امنیتی در دسترس است، اما مسیرهایی که امکان ساخت صفر تا صد یک اکسپلویت را فراهم میکردند، در سطح API قطع شدهاند.»[1]
این تصمیم باعث بازنگری ناگهانی در برنامههای متخصصان امنیت سایبری شد که قصد داشتند Astra را در عملیاتهای خودکار تیم قرمز (Red Team) ادغام کنند. پلتفرم Metacurity در تاریخ ۲ سپتامبر خاطرنشان کرد که اگرچه تیمهای تدافعی همچنان میتوانند از این مدل برای اسکن کدهای خود و یافتن نقصها استفاده کنند، اما ناتوانی در تولید حملات اثبات مفهوم (PoC) تایید این موضوع را که آیا یک آسیبپذیری کشفشده واقعاً قابل اکسپلویت است یا صرفاً یک مثبت کاذب تئوریک است، دشوار میسازد.[7]
یکی از پژوهشگران در مصاحبه با Penligent استدلال کرد: «شما نمیتوانید چیزی را که نمیتوانید خرابیاش را ثابت کنید، بهطور موثری پچ کنید.» این محدودیت نقطه اصطکاکی برای تیمهای امنیتی سازمانها ایجاد میکند، چرا که آنها برای اولویتبندی اینکه کدام آسیبپذیریها نیازمند پچ اضطراری و فوری هستند و کدامیک میتوانند تا چرخههای نگهداری ۳۰ روزه معمول صبر کنند، به کدهای اثبات مفهوم متکیاند.[3]
برای اعمال این مسدودسازی، OpenAI از یک مدل طبقهبند (Classifier) ثانویه و تخصصی استفاده میکند که خروجیهای Astra را در لحظه پایش میکند. اگر این طبقهبند تولید یک زنجیره اکسپلویت کاربردی را تشخیص دهد، پاسخ را رهگیری کرده و یک پیام امتناع استاندارد برمیگرداند. پایگاه Gadgets Now گزارش داد که این سیستم ثانویه حدود ۴۵ میلیثانیه تاخیر به زمان پاسخگویی Astra در سراسر پنجره زمینه ۱۲۸,۰۰۰ توکنی آن اضافه میکند؛ هزینهای که OpenAI آن را برای جلوگیری از گسترش ابزارهای حمله خودکار ضروری دانسته است.[6]
پیامدهای گستردهتر قابلیتهای Astra اکنون کانون توجه و بررسیهای دقیق صنعت امنیت سایبری و نهادهای نظارتی دولتی است. با عبور مدلها از مرز دستیار بودن و تبدیل شدن به عاملهای خودکار، مکانیسمهای مورد استفاده برای مهار آنها با فشار مداوم کاربرانی مواجه خواهند شد که در تلاش برای دور زدن فیلترهای ایمنی هستند. فاز بعدی استقرار نشان خواهد داد که آیا مسدودکنندههای سطح API واقعاً میتوانند مدلی را که ذاتاً میداند چگونه نرمافزارها را در هم بشکند، مهار کنند یا خیر.[4][5]
- توسعهدهندگان هوش مصنوعی
- اولویت دادن به مهار سختگیرانه و مسدودکنندههای ایمنی در سطح API برای جلوگیری از گسترش حملات سایبری خودکار.
- مدافعان سازمانی
- استدلال میکنند که دسترسی به اکسپلویتهای اثبات مفهوم برای تایید آسیبپذیریها و اولویتبندی پچهای نرمافزاری ضروری است.
- پژوهشگران امنیتی
- تمرکز بر تغییر مکانیکی ناشی از توانایی Astra در نقشهبرداری خودکار معماری و زنجیرهسازی آسیبپذیریها.
منابع
[1]OpenAIتوسعهدهندگان هوش مصنوعیSafety overview: GPT-6 Astra
مطالعه در OpenAI →
[2]The Hacker Newsپژوهشگران امنیتیGPT-6 Astra Scores 100% on ExploitBench as OpenAI Blocks PoC Exploit Requests
مطالعه در The Hacker News →
[3]Penligentپژوهشگران امنیتیGPT-6 Astra Zero-Day: How AI Crossed Into Autonomous Exploit Discovery
مطالعه در Penligent →
[4]تیم سردبیری کوهستانتحلیل تیم سردبیری کوهستان
مطالعه در تیم سردبیری کوهستان →
[5]ThePrintپژوهشگران امنیتیGPT-6 Astra is here. What OpenAI's new model can do
مطالعه در ThePrint →
[6]Gadgets Nowپژوهشگران امنیتیWhy OpenAI Astra Brings Stricter Cybersecurity Access Rules For Everyone
مطالعه در Gadgets Now →
[7]Metacurityمدافعان سازمانیOpenAI's Astra crosses the critical cyber threshold
مطالعه در Metacurity →
بیشتر در هوش مصنوعی
مشاهده همه →زیرساخت هوش مصنوعی
چگونه کش KV مشکل تاخیر در مدلهای زبانی بزرگ را حل میکند
7 منبع
بنچمارکهای هوش مصنوعی
ارزیابان مستقل از اختلاف ۳۷ امتیازی در بنچمارک هوش مصنوعی GPT-6 Astra پرده برداشتند
6 منبع
هوش مصنوعی ژنومیک
دیپمایند اطلس آلفاژنوم را برای پیشبینی اثرات ۹ میلیارد جهش دیانای رونمایی کرد
3 منبع
زیرساخت محاسباتی
چگونه «پیجاتنشن» حافظه جیپییو را برای حل گلوگاه زمینه (Context) در مدلهای زبان بزرگ تقسیمبندی میکند؟
3 منبع
نظرات
هر زاویه. هر روز.
اخبار هوش مصنوعی با پوشش کامل منابع و تحلیل دیدگاهها، هر روز و رایگان.





