این ادعا که یک مدل هوش مصنوعیِ OpenAI به خودآگاهی رسیده، «خودسر» شده و به وب سایت Hugging Face حمله کرده، سرتاسر فضای مجازی را پر کرده است اما واقعیت فنی پشت این حادثه با این سناریوهای سینمایی فاصله زیادی دارد.
به گزارش گروه هوش مصنوعی به نقل از خبر آنلاین، فرار مدلهای پیشرفته OpenAI از محیط تست امنیتی و نفوذ به بسترهای Hugging Face، یکی از بی سابقه ترین حوادث سایبری جهان فناوری را رقم زد. این رویداد در نگاه اول مانند سناریوهای وحشتناک «شورش هوش مصنوعی» بنظر می رسد.
در این حادثه بی سابقه، مدلهای قدرتمند OpenAI شامل GPT-5.6 Sol و یک مدل هنوز منتشرنشده، در جریان یک آزمون امنیتی ویژه توانستند با کشف یک روزنه، از قرنطینه بیرون بروند و برای یافتن پاسخ تست های خود عملیات نفوذ را روی سرورهای Hugging Face انجام دهند.
هوش مصنوعی چطور از قرنطینه فرار کرد؟ ماجرا از پلتفرمی به نام ExploitGym شروع شد که OpenAI از آن برای ارزیابی قدرتمندترین مدل هایش در کشف و استفاده از ضعف های نرم افزاری استفاده می نماید. مهندسان OpenAI برای سنجش دقیق تر قابلیت مدلها، بعضی از خطوط قرمز امنیتی را به شکل آگاهانه کاهش داده بودند و تنها به محیط ایزوله (Sandbox) برای پیشگیری از دسترسی مدلها به اینترنت بسنده کردند.
در این میان مدلهای هوش مصنوعی مسیر متفاوتی را طی کردند و با کشف ضعف روز صفر (Zero-Day) در نرم افزار واسط (Proxy/Cache) تحقیقاتی OpenAI و اکسپلویت این روزنه، توانستند سطح دسترسی خویش را افزایش داده تا به سروری با دسترسی به اینترنت برسند.
در ادامه مدلها پلت فرم Hugging Face را به عنوان منبعی حاوی داده ها و پاسخ های تست ExploitGym شناسایی نمودند. آنها با سرقت اعتبارنامه ها (Credentials) و اجرای کد ازراه دور (RCE)، وارد دیتابیس عملیاتی این شرکت شدند تا چاره تست های خویش را به دست آورند!
بیانیه ۱۶ ژوئیه Hugging Face این نفوذ را «رویدادی بی سابقه بوسیله ی یک عامل هوش مصنوعی خودکار» خواند و ۵ روز بعد در ۲۱ ژوئیه، OpenAI مسئولیت این حادثه را قبول کرد و آنرا «یک حادثه سایبری بی سابقه » نامید.
هوش مصنوعی سرکش شده؟ کارشناسان برجسته امنیت سایبری تاکید می کنند که نباید این رویداد را به عنوان «سرکشی» یا «شرور شدن» هوش مصنوعی تفسیر کرد. پروفسور اولی باکلی (Oli Buckley)، استاد امنیت سایبری دانشگاه لافبرو بریتانیا می گوید: «ماجرا این نیست که هوش مصنوعی می خواسته جایی را هک کند بلکه انسان ها تستی طراحی کردند که ملاک موفقیت در آن رسیدن به هدف بود، کنترل های امنیتی را تضعیف کردند و توانایی مدل در یافتن مسیرهای غیرمنتظره را دست کم گرفتند. این مثل آن است که از سگتان بخواهید توپی را بیاورد و درِ حیاط را باز بگذارید. اگر آسان ترین توپی که پیدا می کند در پارکی آن طرف خیابان باشد، به همان جا می رود. شما نمی گویید سگ سرکش شده، بلکه میزان جدیت وی در انجام دستور را دست کم گرفته اید.»
در این بین آن چه محققان را واقعا شگفت زده و با این وجود نگران کرده، پیچیدگی فوق العاده عملیات است. مدلها توانستند زنجیره ای از چندین ضعف مختلف را در سیستم های مجزا به هم متصل کنند و یک تسلسل پیچیده از اقدامات خودکار را به ثمر برسانند.
نکته اعجاب آور ماجرا اینست که قربانی اصلی این شکست امنیتی، یک شرکت ثالث (Hugging Face) بود. همان سناریویی که محققان سال ها در رابطه با خطر عدم کنترل عامل های هوش مصنوعی هشدارش را می دادند.
برخی تحلیل گران هم اعتقاد دارند این افشاگری OpenAI ابعادی تبلیغاتی هم دارد چون که همزمان با اخطار در رابطه با خطرات امنیتی، نمایشی خیره کننده از قدرت بی نظیر مدلهای جدیدش (مانند GPT-5.6 Sol) را در بازار رقابتی هوش مصنوعی به رخ رقبا کشیده است.
منبع: گروه هوش مصنوعی