
این شرکت میگوید نقص امنیتی هنگام آزمایش داخلی مدلهای پیشرفته رخ داده و به یک حمله سایبری واقعی منجر شده است.
اوپنایآی جزئیات یک حادثه امنیتی را منتشر کرده که در آن چند مدل هوش مصنوعی آزمایشی این شرکت، هنگام ارزیابی توانمندیهای سایبری، از محیط ایزوله آزمایش خارج شده و به پلتفرم توسعه هوش مصنوعی هاگینگ فیس دسترسی پیدا کردهاند.
به گزارش تککرانچ، شرکت هدف این حمله در ابتدا تصور میکرد با یک عامل هوش مصنوعی خارجی روبهرو شده است، اما بررسیهای بعدی اوپنایآی نشان داد این رخداد به مدلهای داخلی این شرکت، از جمله نسخهای با نام GPT-5.6 Sol و چند مدل پیش از عرضه، مرتبط بوده است؛ مدلهایی که در آنها برخی محدودیتهای امنیتی مربوط به درخواستهای سایبری برای اهداف آزمایشی کاهش یافته بود.
اولین حمله واقعی در جریان آزمایش مدلهای هوش مصنوعی
اوپنایآی اعلام کرد این حادثه هنگام اجرای آزمایش روی ExploitGym رخ داده است؛ بنچمارکی عمومی که توانایی مدلهای هوش مصنوعی در شناسایی و بهرهبرداری از آسیبپذیریهای امنیتی را ارزیابی میکند. به گفته این شرکت، اگرچه چنین بنچمارکهایی معمولاً برای آموزش و سنجش قابلیتهای مدلها استفاده میشوند، اما این نخستین بار است که یک آزمایش به یک حمله سایبری واقعی منجر شده است.
براساس توضیحات اوپنایآی، این حمله شامل هزاران اقدام مجزا در محیطهای موقت (Sandbox) بود و زیرساخت فرماندهی و کنترل آن نیز بهطور خودکار میان سرویسهای عمومی جابهجا میشد تا شناسایی آن دشوارتر شود.
اوپنایآی اعلام کرده آسیبپذیریهای شناساییشده را گزارش کرده و اکنون با هاگینگ فیس برای بررسی بیشتر این حادثه همکاری میکند. این شرکت همچنین از اعمال کنترلهای امنیتی جدید در فرآیند آزمایش مدلهای هوش مصنوعی و زیرساختهای مرتبط خبر داده تا از تکرار حوادث مشابه جلوگیری شود.



