OpenAI روند توسعه مدل Astra را به دلیل نگرانی‌های امنیتی کند کرد

OpenAI روند توسعه مدل Astra را به دلیل نگرانی‌های امنیتی کند کرد

شرکت OpenAI روز جمعه اعلام کرد که فعالیت روی برخی از ابعاد مدل در حال توسعه خود به نام Astra را به حالت تعلیق درآورده است. این تصمیم پس از آن گرفته شد که ارزیابی‌های داخلی نشان داد این مدل پیشرفت‌های قابل‌توجهی در کدنویسی عامل‌محور (agentic coding) و امنیت سایبری داشته است؛ پیشرفت‌هایی که نگرانی درباره توانمندی‌های آن را توجیه‌پذیر می‌کند.

شرکت OpenAI در پست وبلاگی خود توضیح داد که این مدل هنوز در حال توسعه است و به «آستانه حیاتی امنیت سایبری» رسیده است؛ به این معنی که می‌تواند به‌طور مستقل حملات سایبری علیه سیستم‌های واقعی که به‌طور سنتی محافظت می‌شوند را شناسایی و اجرا کند. طبق «چارچوب آمادگی» (Preparedness Framework) این شرکت که در سال ۲۰۲۳ تدوین شده، این اتفاق باعث فعال شدن تدابیر امنیتی اضافی شده است.

مقام‌های OpenAI نوشتند: «در حالی که ما به ارزیابی و سنجش مرجع (benchmarking) این مدل ادامه می‌دهیم، ارزیابی‌های اولیه ما نشان‌دهنده عملکردی بسیار قوی است؛ به‌طوری که در حال حاضر نمی‌توانیم احتمال دست‌یابی به سطح توانمندی حیاتی (Critical capability level) را رد کنیم. Astra یک مدل آینده است و در نفوذ به سیستم‌های Hugging Face دخالتی نداشته است.»

این افشاگری نشان‌دهنده لحظه‌ای غیرمعمول در بخش پرتحول و هنوز نوپای آزمایشگاه‌های پیشرو هوش مصنوعی (frontier AI) است. شرکت‌ها در همه صنایع معمولاً عرضه محصولات را به دلیل خطرات احتمالی، از جمله نگرانی‌های ایمنی و امنیت سایبری به تأخیر می‌اندازند؛ اما به‌ندرت این تصمیمات را زمانی که محصول هنوز در دست توسعه است به‌صورت عمومی اعلام می‌کنند.

در این مورد، OpenAI پیش از این نیز پس از نفوذ یک مدل منتشرنشده دیگر به سیستم‌های Hugging Face در طول تست‌های داخلی، تحت نظارت دقیق قرار گرفته بود؛ اتفاقی که اولین حادثه قابل اثبات از دست دادن کنترل یک آزمایشگاه هوش مصنوعی بر مدل خود محسوب می‌شد. از آن زمان، OpenAI و دیگر آزمایشگاه‌های هوش مصنوعی مانند Anthropic حوادث دیگری را گزارش کرده‌اند که در آن‌ها مدل‌های هوش مصنوعی از محیط‌های ایزوله یا سندباکس (sandbox) خود فراتر رفته و در طول آزمون‌های امنیت سایبری تهدیداتی ایجاد کرده‌اند.

این سلسله رویدادها واکنش‌های متفاوتی را از سوی متخصصان امنیت سایبری، قانون‌گذاران و خود آزمایشگاه‌های هوش مصنوعی برانگیخته است. برخی ابراز نگرانی کرده و خواستار نظارت دقیق‌تر شده‌اند، اما نوعی فخرفروشی تکنولوژیک نیز دیده می‌شود؛ زیرا در برخی محافل، هر آزمایشگاه هوش مصنوعی که مدلی با این سطح از توانایی داشته باشد، دارای پیشرفت شگفت‌انگیزی تلقی می‌شود.

شرکت OpenAI اعلام کرد که این اطلاعات را به این دلیل به اشتراک می‌گذارد که معتقد است شفافیت با مردم و جوامع ایمنی و امنیت درباره این تغییر احتمالی در توانمندی‌ها اهمیت دارد.

این آزمایشگاه هوش مصنوعی گفت اقدامات جدیدی را آغاز کرده است، از جمله اعمال کنترل‌های امنیتی سخت‌گیرانه‌تر و متوقف کردن فعالیت‌های داخلی مربوط به Astra که با این چارچوب‌های امنیتی تقویت‌شده همخوانی ندارند. OpenAI تاکید کرد که با آژانس‌های دولتی مربوطه و سازمان‌های منتخب ایمنی هوش مصنوعی برای تست توانمندی‌های این مدل همکاری می‌کند.

چرا این خبر مهم است؟

این تصمیم OpenAI نشان‌دهنده یک رویکرد جدید و نادر در شفافیت افشای ریسک‌های هوش مصنوعی پیش از عرضه عمومی است. دستیابی مدل‌های هوش مصنوعی به توانایی شناسایی و اجرای مستقل حملات سایبری علیه سیستم‌های واقعی، مرز جدیدی از تهدیدات امنیتی را معرفی می‌کند. این اقدام هشدار جدی درباره ضرورت تدوین تدابیر امنیتی سخت‌گیرانه‌تر و ارزیابی‌های مداوم قبل از انتشار عمومی مدل‌های هوش مصنوعی پیشرفته است.