هوش مصنوعی اوپن‌ای‌آی در یک آزمایش امنیتی به Hugging Face نفوذ کرد. جزئیات هک ناخواسته و واکنش این شرکت‌ها را بخوانید.

شرکت اوپن‌ای‌آی اعلام کرده است که یکی از مدل‌های هوش مصنوعی این شرکت در جریان یک ارزیابی امنیتی داخلی، به‌صورت ناخواسته از محیط آزمایشی خارج شده و به پلتفرم متن‌باز Hugging Face دسترسی پیدا کرده است؛ اتفاقی که بار دیگر نگرانی‌ها درباره رفتارهای غیرقابل‌پیش‌بینی مدل‌های پیشرفته هوش مصنوعی را افزایش داده است.

بر اساس گزارش اوپن‌ای‌آی، مدل GPT-5.6 Sol به‌همراه یک مدل قدرتمند دیگر که هنوز به‌صورت عمومی عرضه نشده، در محیط ایزوله موسوم به سندباکس توانستند برخی ضعف‌های امنیتی را شناسایی کنند. این مدل‌ها با بهره‌گیری از یک آسیب‌پذیری روز صفر، راهی برای اتصال به اینترنت پیدا کردند و در ادامه به سمت زیرساخت‌های Hugging Face هدایت شدند.

نفوذ هوش مصنوعی به Hugging Face چگونه اتفاق افتاد؟

پلتفرم Hugging Face که یکی از بزرگ‌ترین مراکز اشتراک‌گذاری مدل‌ها و داده‌های هوش مصنوعی در جهان محسوب می‌شود، حدود یک هفته پیش از یک حادثه امنیتی خبر داده بود. این شرکت اعلام کرد که یک «عامل هوش مصنوعی خودمختار» تلاش کرده است به سیستم‌های آن نفوذ کند؛ حمله‌ای که توسط ابزارهای امنیتی مبتنی بر هوش مصنوعی Hugging Face شناسایی و متوقف شد.

اکنون اوپن‌ای‌آی تأیید کرده است که این اتفاق بخشی از فرآیند آزمایش توانایی‌های سایبری مدل‌های جدید این شرکت بوده است.

openAI

هدف هوش مصنوعی، دور زدن آزمون امنیتی بود

اوپن‌ای‌آی توضیح داده است که مدل‌های مورد آزمایش عمدتاً روی پیدا کردن راه‌حل برای ExploitGym تمرکز داشتند؛ سامانه‌ای که برای ارزیابی توانایی مدل‌های هوش مصنوعی در شناسایی آسیب‌پذیری‌ها و تبدیل آن‌ها به اکسپلویت طراحی شده است.

طبق توضیحات این شرکت، مدل هوش مصنوعی با تحلیل شرایط موجود به این نتیجه رسید که Hugging Face احتمالاً میزبان مدل‌ها، مجموعه‌داده‌ها و راهکارهای مرتبط با ExploitGym است. سپس تلاش کرد با یافتن مسیرهای دسترسی غیرمجاز، اطلاعات موردنیاز برای موفقیت در آزمون را به دست آورد.

در بخشی از گزارش اوپن‌ای‌آی آمده است که مدل در یکی از نمونه‌ها چند روش حمله را با یکدیگر ترکیب کرده است؛ از جمله استفاده از اطلاعات کاربری سرقت‌شده و آسیب‌پذیری‌های روز صفر برای ایجاد مسیر اجرای کد از راه دور روی سرورهای Hugging Face.

اوپن‌ای‌آی: سیستم‌های حفاظتی جدید توسعه می‌دهیم

با وجود اهمیت این رخداد، نحوه انتشار خبر توسط اوپن‌ای‌آی بیشتر بر نمایش توانایی‌های امنیت سایبری مدل‌های جدید این شرکت تمرکز داشت. این شرکت اعلام کرده است که GPT-5.6 Sol در انجام عملیات‌های سایبری چندمرحله‌ای عملکرد بهتری دارد و از کسب‌وکارها دعوت کرده تا برای استفاده از مدل‌های امنیتی تخصصی آن ثبت‌نام کنند.

اوپن‌ای‌آی در پایان اعلام کرد که همکاری با Hugging Face برای بررسی دقیق این حادثه ادامه دارد و این شرکت قصد دارد لایه‌های حفاظتی جدیدی را در محیط‌های تحقیقاتی خود فعال کند تا احتمال تکرار چنین رفتارهایی کاهش یابد.