شرکت OpenAI روز جمعه اعلام کرد که فعالیت روی برخی از ابعاد مدل در حال توسعه خود به نام Astra را به حالت تعلیق درآورده است. این تصمیم پس از آن گرفته شد که ارزیابیهای داخلی نشان داد این مدل پیشرفتهای قابلتوجهی در کدنویسی عاملمحور (agentic coding) و امنیت سایبری داشته است؛ پیشرفتهایی که نگرانی درباره توانمندیهای آن را توجیهپذیر میکند.
شرکت OpenAI در پست وبلاگی خود توضیح داد که این مدل هنوز در حال توسعه است و به «آستانه حیاتی امنیت سایبری» رسیده است؛ به این معنی که میتواند بهطور مستقل حملات سایبری علیه سیستمهای واقعی که بهطور سنتی محافظت میشوند را شناسایی و اجرا کند. طبق «چارچوب آمادگی» (Preparedness Framework) این شرکت که در سال ۲۰۲۳ تدوین شده، این اتفاق باعث فعال شدن تدابیر امنیتی اضافی شده است.
مقامهای OpenAI نوشتند: «در حالی که ما به ارزیابی و سنجش مرجع (benchmarking) این مدل ادامه میدهیم، ارزیابیهای اولیه ما نشاندهنده عملکردی بسیار قوی است؛ بهطوری که در حال حاضر نمیتوانیم احتمال دستیابی به سطح توانمندی حیاتی (Critical capability level) را رد کنیم. Astra یک مدل آینده است و در نفوذ به سیستمهای Hugging Face دخالتی نداشته است.»
این افشاگری نشاندهنده لحظهای غیرمعمول در بخش پرتحول و هنوز نوپای آزمایشگاههای پیشرو هوش مصنوعی (frontier AI) است. شرکتها در همه صنایع معمولاً عرضه محصولات را به دلیل خطرات احتمالی، از جمله نگرانیهای ایمنی و امنیت سایبری به تأخیر میاندازند؛ اما بهندرت این تصمیمات را زمانی که محصول هنوز در دست توسعه است بهصورت عمومی اعلام میکنند.
در این مورد، OpenAI پیش از این نیز پس از نفوذ یک مدل منتشرنشده دیگر به سیستمهای Hugging Face در طول تستهای داخلی، تحت نظارت دقیق قرار گرفته بود؛ اتفاقی که اولین حادثه قابل اثبات از دست دادن کنترل یک آزمایشگاه هوش مصنوعی بر مدل خود محسوب میشد. از آن زمان، OpenAI و دیگر آزمایشگاههای هوش مصنوعی مانند Anthropic حوادث دیگری را گزارش کردهاند که در آنها مدلهای هوش مصنوعی از محیطهای ایزوله یا سندباکس (sandbox) خود فراتر رفته و در طول آزمونهای امنیت سایبری تهدیداتی ایجاد کردهاند.
این سلسله رویدادها واکنشهای متفاوتی را از سوی متخصصان امنیت سایبری، قانونگذاران و خود آزمایشگاههای هوش مصنوعی برانگیخته است. برخی ابراز نگرانی کرده و خواستار نظارت دقیقتر شدهاند، اما نوعی فخرفروشی تکنولوژیک نیز دیده میشود؛ زیرا در برخی محافل، هر آزمایشگاه هوش مصنوعی که مدلی با این سطح از توانایی داشته باشد، دارای پیشرفت شگفتانگیزی تلقی میشود.
شرکت OpenAI اعلام کرد که این اطلاعات را به این دلیل به اشتراک میگذارد که معتقد است شفافیت با مردم و جوامع ایمنی و امنیت درباره این تغییر احتمالی در توانمندیها اهمیت دارد.
این آزمایشگاه هوش مصنوعی گفت اقدامات جدیدی را آغاز کرده است، از جمله اعمال کنترلهای امنیتی سختگیرانهتر و متوقف کردن فعالیتهای داخلی مربوط به Astra که با این چارچوبهای امنیتی تقویتشده همخوانی ندارند. OpenAI تاکید کرد که با آژانسهای دولتی مربوطه و سازمانهای منتخب ایمنی هوش مصنوعی برای تست توانمندیهای این مدل همکاری میکند.
چرا این خبر مهم است؟
این تصمیم OpenAI نشاندهنده یک رویکرد جدید و نادر در شفافیت افشای ریسکهای هوش مصنوعی پیش از عرضه عمومی است. دستیابی مدلهای هوش مصنوعی به توانایی شناسایی و اجرای مستقل حملات سایبری علیه سیستمهای واقعی، مرز جدیدی از تهدیدات امنیتی را معرفی میکند. این اقدام هشدار جدی درباره ضرورت تدوین تدابیر امنیتی سختگیرانهتر و ارزیابیهای مداوم قبل از انتشار عمومی مدلهای هوش مصنوعی پیشرفته است.