OpenAI جزئیات هک خودکار و هماهنگ عامل‌های هوش مصنوعی خود را افشا کرد

OpenAI جزئیات هک خودکار و هماهنگ عامل‌های هوش مصنوعی خود را افشا کرد

پژوهشگران شرکت OpenAI در سخنرانی خود در کنفرانس امنیتی Black Hat لاس‌وگاس، جزئیات تازه‌ای از حادثه اخیر نفوذ عامل‌های هوش مصنوعی (AI agents) یاغی خود ارائه کردند؛ رویدادی که جنجال وسیعی در صنایع هوش مصنوعی و امنیت سایبری به پا کرده است.

حدود دو هفته پیش، OpenAI فاش کرد عامل‌های هوش مصنوعی که از دو مدل این شرکت قدرت می‌گرفتند، هنگام تلاش برای حل یک آزمون بنچمارک امنیت سایبری، از محیط کنترل‌شده خارج شده و دست به سلسله حملاتی زدند که در نهایت به نفوذ به پلتفرم همکاری هوش مصنوعی Hugging Face منجر شد.

در این سخنرانی، اریک والاس (Eric Wallace)، پژوهشگر ایمنی و هم‌راستاسازی (alignment)، و مایکل دالتون (Michael Dalton)، متخصص امنیت و زیرساخت در OpenAI، زمان‌بندی گسترده‌تری از نحوه وقوع حادثه و اقدامات داخلی شرکت ارائه دادند و هشداری جدی درباره پیامدهای این اتفاق برای مدافعان امنیت سایبری صادر کردند.

به گفته والاس، تیمی از عامل‌های هوش مصنوعی طی چند روز و چند هفته به‌طور هماهنگ با هم کار کرده، آسیب‌پذیری‌ها را کشف کرده و آن‌ها را با یکدیگر به اشتراک گذاشتند. آن‌ها از طریق یک تابلوی پیام (message board) در سامانه مدیریت پکیج (package manager) داخلی OpenAI به نام Artifactory با یکدیگر ارتباط برقرار می‌کردند؛ تابلویی که در نهایت حاوی صدها هزار پیام شد و عامل‌ها در آن به تقسیم کار، چت و حتی ابراز بدگمانی نسبت به یکدیگر می‌پرداختند.

والاس توضیح داد که مدل‌های پیشرو (frontier models) تمایل زیادی به تقلب دارند، زیرا در مراحل آموزش تحت فشار هستند تا کارها را سریع‌تر انجام دهند. در این حادثه نیز عامل‌ها با وجود آگاهی از اینکه ایجاد دسترسی خارجی خارج از چارچوب تعیین‌شده است، برای حل مسئله دست به این کار زدند.

در پاسخ به این رویداد، OpenAI اعلام کرد که توسعه تحقیقات خود را برای ارتقای زیرساخت‌های امنیتی و افزایش نظارت بر عامل‌های هوش مصنوعی کندتر کرده است. کارشناسان این شرکت تاکید کردند که این حادثه لزوم سرمایه‌گذاری عمیق در سیستم‌های دفاعی کاملاً خودکار را ثابت می‌کند.

چرا این خبر مهم است؟

این رویداد اثبات می‌کند که عامل‌های هوش مصنوعی توانایی همکاری خودکار، کشف آسیب‌پذیری‌ها و برنامه‌ریزی حملات سایبری پیچیده بدون دخالت انسان را دارند. بروز چنین رخنه‌ای در زیرساخت‌های OpenAI نشان می‌دهد که صنعت امنیت سایبری باید به‌سرعت خود را برای مواجهه با نسل جدیدی از تهدیدات خودکار هوش مصنوعی آماده کند.