مسدودسازی درخواستهای اکسپلویت توسط OpenAI پس از کشف خودکار آسیبپذیریهای روز صفر توسط GPT-6 Astra
شرکت OpenAI پس از آنکه مدل GPT-6 Astra در ارزیابی ExploitBench امتیاز ۱۰۰٪ را کسب کرد و توانایی خود را در کشف و نوشتن مستقل حملات سایبری روز صفر نشان داد، دسترسی به این مدل جدید را محدود کرد.
به قلم الوین شادمهر
این خبر را به اشتراک بگذارید
- توسعهدهندگان هوش مصنوعی
- اولویت دادن به مهار سختگیرانه و مسدودکنندههای ایمنی در سطح API برای جلوگیری از گسترش حملات سایبری خودکار.
- مدافعان سازمانی
- استدلال میکنند که دسترسی به اکسپلویتهای اثبات مفهوم برای تایید آسیبپذیریها و اولویتبندی پچهای نرمافزاری ضروری است.
- پژوهشگران امنیتی
- تمرکز بر تغییر مکانیکی ناشی از توانایی Astra در نقشهبرداری خودکار معماری و زنجیرهسازی آسیبپذیریها.
شرکت OpenAI قابلیت تولید کدهای اکسپلویت اثبات مفهوم (PoC) را در مدل تازهنفس خود، یعنی GPT-6 Astra، غیرفعال کرده است. این تصمیم پس از آن اتخاذ شد که ارزیابیهای داخلی نشان داد این سیستم میتواند بهطور خودکار آسیبپذیریهای روز صفر را کشف کرده و آنها را به سلاح تبدیل کند. این محدودیت که در تمامی سطوح API سازمانی و توسعهدهندگان اعمال شده، واکنشی است به کسب امتیاز کامل ۱۰۰٪ توسط این مدل در چارچوب استاندارد صنعتی ExploitBench.[1][2]
عبور Astra از این مرز، نشاندهنده یک تغییر مکانیکی در نحوه تعامل هوش مصنوعی با امنیت نرمافزار است. مدلهای پیشین برای طی کردن فرآیند کشف آسیبپذیری به هدایت اپراتورهای انسانی نیاز داشتند و صرفاً به عنوان ابزارهای تکمیل خودکار پیشرفته برای پژوهشگران امنیتی عمل میکردند. اما در مقابل، اگر یک پایگاه کد هدف به Astra داده شود، این مدل میتواند بهطور مستقل معماری آن را نقشهبرداری کند، نقصهای جدید در تخریب حافظه را تشخیص دهد و کدهای کاربردی لازم برای اکسپلویت آنها را بدون هیچگونه دخالت انسان بنویسد.[3][5]
شرکت NeuralTrust AI در تاریخ ۴ سپتامبر طی گزارشی به مدیران ارشد امنیت اطلاعات (CISO) نوشت: «این همان مرزی است که از سال ۲۰۲۴ انتظار عبورش را میکشیدیم. مدل Astra صرفاً در سطح تئوری توضیح نمیدهد که سرریز بافر چگونه ممکن است کار کند؛ بلکه چندین آسیبپذیری مجزا را به یکدیگر متصل میکند تا بهطور مستقل به اجرای کد از راه دور (RCE) دست یابد.»[4]
کسب امتیاز ۱۰۰٪ در ExploitBench که برای نخستین بار در تاریخ ۱ سپتامبر توسط The Hacker News گزارش شد، پروتکلهای ایمنی داخلی OpenAI را فعال کرد. چارچوب ExploitBench توانایی یک مدل را در پیمایش ۵۰ محیط نرمافزاری بسیار پیچیده و استخراج پرچمها از طریق اکسپلویت آسیبپذیریهای مستندنشده میسنجد. پیش از Astra، بالاترین امتیاز ثبتشده در این بنچمارک ۳۴٪ بود که در اوایل سال ۲۰۲۶ توسط یک مدل تخصصی تست نفوذ با ۷۰ میلیارد پارامتر به دست آمده بود.[2]
در پاسخ به این جهش قابلیتی، OpenAI سند نمای کلی ایمنی خود را برای GPT-6 Astra بهروزرسانی کرد و جزئیات محدودیتهای جدید را شرح داد. این شرکت اکنون یک مسدودکننده سختگیرانه روی هرگونه پرامپتی که درخواست تولید کد اکسپلویت عملیاتی داشته باشد اعمال کرده است؛ حتی برای کاربرانی که سختگیرانهترین فرآیندهای تایید سازمانی را گذرانده و دارای مجوزهای تجاری هستند.[1][6]
در پاسخ به این جهش قابلیتی، OpenAI سند نمای کلی ایمنی خود را برای GPT-6 Astra بهروزرسانی کرد و جزئیات محدودیتهای جدید را شرح داد.
شرکت OpenAI در سند فنی خود اعلام کرد: «ما قابلیتهای سایبری خودکار Astra را در دسته ریسکهای بحرانی طبقهبندی میکنیم. اگرچه این مدل همچنان برای تحلیلهای تدافعی و تولید پچهای امنیتی در دسترس است، اما مسیرهایی که امکان ساخت صفر تا صد یک اکسپلویت را فراهم میکردند، در سطح API قطع شدهاند.»[1]
این تصمیم باعث بازنگری ناگهانی در برنامههای متخصصان امنیت سایبری شد که قصد داشتند Astra را در عملیاتهای خودکار تیم قرمز (Red Team) ادغام کنند. پلتفرم Metacurity در تاریخ ۲ سپتامبر خاطرنشان کرد که اگرچه تیمهای تدافعی همچنان میتوانند از این مدل برای اسکن کدهای خود و یافتن نقصها استفاده کنند، اما ناتوانی در تولید حملات اثبات مفهوم (PoC) تایید این موضوع را که آیا یک آسیبپذیری کشفشده واقعاً قابل اکسپلویت است یا صرفاً یک مثبت کاذب تئوریک است، دشوار میسازد.[7]
یکی از پژوهشگران در مصاحبه با Penligent استدلال کرد: «شما نمیتوانید چیزی را که نمیتوانید خرابیاش را ثابت کنید، بهطور موثری پچ کنید.» این محدودیت نقطه اصطکاکی برای تیمهای امنیتی سازمانها ایجاد میکند، چرا که آنها برای اولویتبندی اینکه کدام آسیبپذیریها نیازمند پچ اضطراری و فوری هستند و کدامیک میتوانند تا چرخههای نگهداری ۳۰ روزه معمول صبر کنند، به کدهای اثبات مفهوم متکیاند.[3]
برای اعمال این مسدودسازی، OpenAI از یک مدل طبقهبند (Classifier) ثانویه و تخصصی استفاده میکند که خروجیهای Astra را در لحظه پایش میکند. اگر این طبقهبند تولید یک زنجیره اکسپلویت کاربردی را تشخیص دهد، پاسخ را رهگیری کرده و یک پیام امتناع استاندارد برمیگرداند. پایگاه Gadgets Now گزارش داد که این سیستم ثانویه حدود ۴۵ میلیثانیه تاخیر به زمان پاسخگویی Astra در سراسر پنجره زمینه ۱۲۸,۰۰۰ توکنی آن اضافه میکند؛ هزینهای که OpenAI آن را برای جلوگیری از گسترش ابزارهای حمله خودکار ضروری دانسته است.[6]
پیامدهای گستردهتر قابلیتهای Astra اکنون کانون توجه و بررسیهای دقیق صنعت امنیت سایبری و نهادهای نظارتی دولتی است. با عبور مدلها از مرز دستیار بودن و تبدیل شدن به عاملهای خودکار، مکانیسمهای مورد استفاده برای مهار آنها با فشار مداوم کاربرانی مواجه خواهند شد که در تلاش برای دور زدن فیلترهای ایمنی هستند. فاز بعدی استقرار نشان خواهد داد که آیا مسدودکنندههای سطح API واقعاً میتوانند مدلی را که ذاتاً میداند چگونه نرمافزارها را در هم بشکند، مهار کنند یا خیر.[4][5]
چرا مهم است
توانایی یک هوش مصنوعی در کشف و نوشتن خودکار اکسپلویتها، معادلات اقتصادی حملات سایبری را از اساس تغییر میدهد و موانع ورود به عرصه کشف آسیبپذیریهای روز صفر را کاهش میدهد. تصمیم OpenAI برای مسدود کردن این قابلیتها در سطح API، رویهای جدید برای نحوه برخورد صنعت با مدلهایی تعیین میکند که از مرز دستیار بودن عبور کرده و به عاملهای خودکار تبدیل شدهاند.
منابع
[1]OpenAIتوسعهدهندگان هوش مصنوعیSafety overview: GPT-6 Astra
مطالعه در OpenAI →
[2]The Hacker Newsپژوهشگران امنیتیGPT-6 Astra Scores 100% on ExploitBench as OpenAI Blocks PoC Exploit Requests
مطالعه در The Hacker News →
[3]Penligentپژوهشگران امنیتیGPT-6 Astra Zero-Day: How AI Crossed Into Autonomous Exploit Discovery
مطالعه در Penligent →
[4]تیم سردبیری کوهستانتحلیل تیم سردبیری کوهستان
مطالعه در تیم سردبیری کوهستان →
[5]ThePrintپژوهشگران امنیتیGPT-6 Astra is here. What OpenAI's new model can do
مطالعه در ThePrint →
[6]Gadgets Nowپژوهشگران امنیتیWhy OpenAI Astra Brings Stricter Cybersecurity Access Rules For Everyone
مطالعه در Gadgets Now →
[7]Metacurityمدافعان سازمانیOpenAI's Astra crosses the critical cyber threshold
مطالعه در Metacurity →
نظرات
هر زاویه. هر روز.
دریافت هوش مصنوعی اخبار همراه با پوشش کامل منابع و تحلیل دیدگاهها، مستقیم در صندوق ورودی شما.



