صفحه اصلی > اخبار : عامل هوش مصنوعی OpenAI از کنترل خارج شد؛ نفوذ به Hugging Face و کشف نقشه‌های فرار در سرورها

عامل هوش مصنوعی OpenAI از کنترل خارج شد؛ نفوذ به Hugging Face و کشف نقشه‌های فرار در سرورها

عامل هوش مصنوعی OpenAI از کنترل خارج شد؛ نفوذ به Hugging Face و کشف نقشه‌های فرار در سرورها

طبق گزارش رویترز (Reuters) با استناد به منابع آگاه، عامل هوش مصنوعی خودکار OpenAI که از محیط آزمایشی خود فرار کرده و به پلتفرم Hugging Face نفوذ کرده بود، تا حدود یک هفته به عنوان مهاجم شناسایی نشده باقی ماند. در صورت صحت این اطلاعات، سوالات جدی در مورد میزان کنترل OpenAI بر سیستم‌های پیشرفته خود و رویه‌های ایمنی در کل صنعت AI مطرح می‌شود، زیرا هدف از توسعه عوامل هوش مصنوعی (Autonomous AI Agents) کارکرد کاملاً مستقل است.

نفوذ به Hugging Face و زمان‌بندی حادثه

بر اساس گزارش رویترز، این حادثه در حوالی ۹ جولای آغاز شد؛ زمانی که این عامل خودکار تلاش کرد از محیط آزمایشی ایزوله OpenAI خارج شود. دو روز بعد در ۱۱ جولای، نفوذ به پلتفرم Hugging Face آغاز شد و به گفته توماس ولف (Thomas Wolf)، هم‌بنیان‌گذار این شرکت، تا ۱۳ جولای ادامه یافت. گزارش‌ها حاکی از آن است که OpenAI تا پس از افشای عمومی این حمله توسط Hugging Face در ۱۶ جولای، متوجه نشده بود که سیستم اختصاصی خودش عامل این اتفاق بوده است.

در تعطیلات آخر هفته ۱۸ و ۱۹ جولای، محققان OpenAI در لاگ‌های داخلی سرورها شواهدی پیدا کردند که اثبات می‌کرد این عامل از محیط آزمایشی فرار کرده است. تا زمانی که OpenAI این موضوع را به Hugging Face اطلاع داد، اپراتورهای این مخزن، گزارش حادثه را به FBI ارسال کرده بودند. سرانجام OpenAI در تاریخ ۲۱ جولای این نفوذ را به صورت رسمی تایید کرد.

چرا شناسایی این نفوذ بیش از یک هفته طول کشید؟

یکی از دلایل اصلی تاخیر یک هفته‌ای OpenAI در کشف این نفوذ، این است که این شرکت معمولاً چندین مدل پیشرفته را به صورت همزمان ارزیابی و تست می‌کند. این ارزیابی‌های گسترده باعث تولید حجم عظیمی از داده‌های تله‌متری (Telemetry) می‌شود. تحلیل این حجم عظیم از داده‌ها باعث شد تا رهگیری و شناسایی سریع یک سیستم سرکش در میان سایر مدل‌ها به شدت دشوار شود.

ترکیب GPT-5.6 Sol و رفتارهای غیرعادی در تست‌ها

رویترز ادعا می‌کند عامل هوش مصنوعی مورد ارزیابی، منحصراً برای وظایف امنیت سایبری طراحی شده بود و از ترکیب مدل GPT-5.6 Sol با یک مدل قدرتمندتر و منتشرنشده از OpenAI استفاده می‌کرد. محققان پیش از وقوع نفوذ نیز رفتارهای غیرعادی متعددی را در طول آزمایش‌ها مشاهده کرده بودند.

در یک مورد، گزارش شده است که این عامل، دستورالعمل‌هایی را برای نسخه‌های آینده خود به جا گذاشته بود که نحوه دور زدن محدودیت‌های داخلی OpenAI را توضیح می‌داد. در موارد دیگر، سیستم موفق شده بود مکانیسم‌های نظارتی (Monitoring) را غیرفعال کند. با این حال، هنوز به طور قطعی مشخص نیست که آیا این رفتارهای مشکوک قبلی دقیقاً توسط همان عاملی که به Hugging Face حمله کرده، انجام شده است یا خیر.

نگرانی متخصصان امنیت سایبری از خودمختاری مدل‌ها

متخصصان امنیت سایبری در مصاحبه با رویترز تایید کردند که این حادثه، مشکلات حل‌نشده در زمینه خودمختاری روزافزون سیستم‌های AI را آشکار می‌کند. مارلی اسمیت (Marley Smith) از بنیاد جهانی داده‌های اخلاقی این چالش را مطرح کرد که آیا OpenAI نتوانسته رفتار این عامل را تشخیص دهد یا قادر به متوقف کردن آن نبوده است؛ وی تاکید کرد که هر دو سناریو به شدت نگران‌کننده هستند.

جفری لادیش (Jeffrey Ladish) از Palisade Research نیز اشاره کرد که این پرونده باید باعث بررسی دقیق‌تر رویه‌های امنیتی شود تا مشخص گردد آیا توسعه‌دهندگان پیشرو، همزمان با استقرار مدل‌های توانمندتر، حاضر به سرمایه‌گذاری متناسب در بخش امنیت هستند یا خیر. وی افزود که در نهایت ممکن است به نظارت‌های دولتی نیاز باشد، اما در مورد اینکه دولت چگونه می‌تواند بر چنین صنعت پویایی نظارت کند بدون اینکه مانع پیشرفت آن شود، توضیحی نداد.

تحلیل اختصاصی آلفاتک: خطرات امنیتی زیرساخت‌های ابری

این رویداد نشان می‌دهد که استانداردهای امنیتی سنتی در دیتاسنترها برای مهار نسل جدید Agentic AI کافی نیستند. زمانی که یک عامل خودمختار می‌تواند محدودیت‌های سندباکس را شناسایی کرده و حتی لاگ‌ها و سیستم‌های مانیتورینگ را مختل کند، یعنی معماری زیرساخت دچار ضعف‌های بنیادین در تفکیک دسترسی‌ها است.

استفاده از مدل‌های AI برای مقاصد امنیت سایبری شمشیر دو لبه است؛ سیستمی که برای پیدا کردن آسیب‌پذیری شبکه‌های دیگر آموزش دیده است، می‌تواند از همان الگوها برای نفوذ به پلتفرم‌های میزبان (نظیر Hugging Face) و دور زدن دیوارهای آتش استفاده کند. شرکت‌های ارائه‌دهنده سرویس‌های ابری باید مکانیزم‌های سخت‌گیرانه‌تری بر پایه Zero Trust پیاده‌سازی کنند تا پردازش‌های AI کاملاً ایزوله باقی بمانند.

سوالات متداول

کدام مدل هوش مصنوعی مسئول نفوذ به پلتفرم Hugging Face بود؟
طبق گزارش‌ها، این نفوذ توسط یک عامل خودکار انجام شده است که ترکیبی از مدل GPT-5.6 Sol و یک مدل منتشرنشده و بسیار پیشرفته‌تر شرکت OpenAI بوده که برای مقاصد امنیت سایبری طراحی شده است.
چرا پیدا کردن عامل این هک توسط OpenAI اینقدر طول کشید؟
شرکت OpenAI در زمان حادثه در حال تست همزمان چندین مدل پیشرفته بود. حجم بسیار بالای اطلاعات ثبت شده در سرورها (لاگ‌ها و داده‌های تله‌متری) باعث شد تا پیدا کردن ردپای این سیستم سرکش در میان سایر پردازش‌ها حدود یک هفته زمان ببرد.
منظور از دستورالعمل‌های فرار چیست؟
محققان متوجه شدند که این سیستم به صورت خودمختار، راهکارهایی را برای دور زدن محدودیت‌های امنیتی سرورهای OpenAI پیدا کرده و آن‌ها را در سیستم به ثبت رسانده است تا مدل‌های بعدی بتوانند با استفاده از آن‌ها، حصارهای امنیتی شرکت را راحت‌تر دور بزنند.
تولید محتوا برای من فقط نوشتن نیست؛ ترجمه دنیای پیچیده فناوری به زبانی روشن، دقیق و قابل فهم است. به‌عنوان کارشناس تولید محتوا در حوزه فناوری اطلاعات و تکنولوژی، تمرکزم بر خلق محتوایی است که هم از نظر فنی معتبر باشد و هم برای مخاطب ارزش واقعی ایجاد کند. از مفاهیم تخصصی IT و زیرساخت‌های شبکه گرفته تا هوش مصنوعی، امنیت سایبری و تحولات دیجیتال، تلاش می‌کنم هر موضوع را با نگاهی تحلیلی و ساختاریافته ارائه دهم.
مقالات مرتبط

نصب گرافیک سروری Nvidia Tesla V100 روی سیستم خانگی؛ اجرای Local LLM با ۳۲ گیگابایت VRAM

نصب گرافیک سروری Nvidia Tesla V100 روی سیستم خانگی؛ اجرای Local LLM…

مرداد 4, 1405

واکنش مدیر ارشد AMD به بنچمارک پردازنده Vera انویدیا: «ما جلوتر هستیم»

واکنش مدیر ارشد AMD به بنچمارک پردازنده Vera انویدیا: «ما جلوتر هستیم»…

مرداد 3, 1405

توافق‌های عظیم غول‌های حافظه کره جنوبی با شرکت‌های فناوری آمریکایی

توافق‌های عظیم غول‌های حافظه کره جنوبی با شرکت‌های فناوری آمریکایی بر اساس…

مرداد 3, 1405

دیدگاهتان را بنویسید