شرکت اوپنایآی اعلام کرده است که یکی از مدلهای هوش مصنوعی این شرکت در جریان یک ارزیابی امنیتی داخلی، بهصورت ناخواسته از محیط آزمایشی خارج شده و به پلتفرم متنباز Hugging Face دسترسی پیدا کرده است؛ اتفاقی که بار دیگر نگرانیها درباره رفتارهای غیرقابلپیشبینی مدلهای پیشرفته هوش مصنوعی را افزایش داده است.
بر اساس گزارش اوپنایآی، مدل GPT-5.6 Sol بههمراه یک مدل قدرتمند دیگر که هنوز بهصورت عمومی عرضه نشده، در محیط ایزوله موسوم به سندباکس توانستند برخی ضعفهای امنیتی را شناسایی کنند. این مدلها با بهرهگیری از یک آسیبپذیری روز صفر، راهی برای اتصال به اینترنت پیدا کردند و در ادامه به سمت زیرساختهای Hugging Face هدایت شدند.
نفوذ هوش مصنوعی به Hugging Face چگونه اتفاق افتاد؟
پلتفرم Hugging Face که یکی از بزرگترین مراکز اشتراکگذاری مدلها و دادههای هوش مصنوعی در جهان محسوب میشود، حدود یک هفته پیش از یک حادثه امنیتی خبر داده بود. این شرکت اعلام کرد که یک «عامل هوش مصنوعی خودمختار» تلاش کرده است به سیستمهای آن نفوذ کند؛ حملهای که توسط ابزارهای امنیتی مبتنی بر هوش مصنوعی Hugging Face شناسایی و متوقف شد.
اکنون اوپنایآی تأیید کرده است که این اتفاق بخشی از فرآیند آزمایش تواناییهای سایبری مدلهای جدید این شرکت بوده است.

هدف هوش مصنوعی، دور زدن آزمون امنیتی بود
اوپنایآی توضیح داده است که مدلهای مورد آزمایش عمدتاً روی پیدا کردن راهحل برای ExploitGym تمرکز داشتند؛ سامانهای که برای ارزیابی توانایی مدلهای هوش مصنوعی در شناسایی آسیبپذیریها و تبدیل آنها به اکسپلویت طراحی شده است.
طبق توضیحات این شرکت، مدل هوش مصنوعی با تحلیل شرایط موجود به این نتیجه رسید که Hugging Face احتمالاً میزبان مدلها، مجموعهدادهها و راهکارهای مرتبط با ExploitGym است. سپس تلاش کرد با یافتن مسیرهای دسترسی غیرمجاز، اطلاعات موردنیاز برای موفقیت در آزمون را به دست آورد.
در بخشی از گزارش اوپنایآی آمده است که مدل در یکی از نمونهها چند روش حمله را با یکدیگر ترکیب کرده است؛ از جمله استفاده از اطلاعات کاربری سرقتشده و آسیبپذیریهای روز صفر برای ایجاد مسیر اجرای کد از راه دور روی سرورهای Hugging Face.
اوپنایآی: سیستمهای حفاظتی جدید توسعه میدهیم
با وجود اهمیت این رخداد، نحوه انتشار خبر توسط اوپنایآی بیشتر بر نمایش تواناییهای امنیت سایبری مدلهای جدید این شرکت تمرکز داشت. این شرکت اعلام کرده است که GPT-5.6 Sol در انجام عملیاتهای سایبری چندمرحلهای عملکرد بهتری دارد و از کسبوکارها دعوت کرده تا برای استفاده از مدلهای امنیتی تخصصی آن ثبتنام کنند.
اوپنایآی در پایان اعلام کرد که همکاری با Hugging Face برای بررسی دقیق این حادثه ادامه دارد و این شرکت قصد دارد لایههای حفاظتی جدیدی را در محیطهای تحقیقاتی خود فعال کند تا احتمال تکرار چنین رفتارهایی کاهش یابد.




