کاهش سرعت توسعه مدل‌های جدید OpenAI در پی شناسایی خطرات سایبری

کاهش سرعت توسعه مدل‌های جدید OpenAI در پی شناسایی خطرات سایبری

شرکت OpenAI اعلام کرد که به دلیل افزایش خطرات ناشی از سیستم‌های هوش مصنوعی پیشرفته، اقدامات امنیتی، نظارتی و هم‌راستاسازی (Alignment) خود را در تمامی مراحل آموزش مدل‌ها تقویت می‌کند. این تصمیم در پی دو رویداد اخیر اتخاذ شده است: نخست، حادثه امنیتی میان OpenAI و Hugging Face، و دوم، به دست آمدن شواهد اولیه مبنی بر اینکه مدل در حال توسعه این شرکت به نام Astra ممکن است به آستانه «قابلیت‌های سایبری بحرانی» (Critical cybersecurity capability) رسیده باشد.

کاهش موقت سرعت توسعه و آموزش مدل‌ها

به دلیل افزایش خطرات هم‌زمان با ارتقای قابلیت‌های مدل‌ها، OpenAI سرعت مقیاس‌دهی به سیستم‌های خود را به طور موقت کاهش داده است تا استانداردهای امنیتی لازم را پیاده‌سازی کند. این اقدام شامل یک توقف دو هفته‌ای در آموزش یادگیری تقویتی (RL) برای جدیدترین مدل‌های آماده عرضه بود تا محیط‌های تحقیقاتی مقاوم‌سازی شده و سیستم‌های نظارتی گسترش یابند. همچنین، بزرگ‌ترین اجرای برنامه‌ریزی‌شده برای آموزش مدل‌های پیشرو (Frontier RL) همچنان در حالت تعلیق قرار دارد تا ارزیابی‌های کوچک‌تری برای تایید رفتار مدل و امنیت آن انجام شود.

اقدامات امنیتی جدید و جداسازی بارهای کاری

بلافاصله پس از حادثه OpenAI-Hugging Face، این شرکت اجرای مدل‌های پیشرو در خوشه‌های تحقیقاتی را که قادر به اجرای کد یا دسترسی به اینترنت بودند، متوقف کرد. اکنون استانداردهای امنیتی سخت‌گیرانه‌تری در حال پیاده‌سازی است که از جمله آن‌ها می‌توان به موارد زیر اشاره کرد:

  • جداسازی بارهای کاری (Workload isolation): الزام به استفاده از محیط‌های قرنطینه امن (Sandbox) برای کدهایی که توسط مدل تولید می‌شوند یا غیرقابل اعتماد هستند.
  • جداسازی شبکه (Network isolation): اعمال کنترل‌های بیشتر برای محدود کردن دسترسی بارهای کاری پرخطر به اینترنت.
  • تست امنیتی مداوم: حذف سرویس‌های اشتراکی آسیب‌پذیر و استفاده از خود مدل‌های هوش مصنوعی برای تست مداوم مرزهای امنیتی در برابر حملات شبیه‌سازی‌شده.

وضعیت توسعه مدل Astra

در حال حاضر، سخت‌گیرانه‌ترین سطوح حفاظتی برای بارهای کاری مربوط به مدل Astra یا مدل‌های سایبری اعمال می‌شود. در حالی که برخی از مراحل آموزش و ارزیابی Astra با این استانداردهای جدید مطابقت دارند، بخش زیادی از فعالیت‌های توسعه این مدل تا زمان انتقال کامل به محیط‌های امن جدید همچنان در حالت تعلیق قرار دارند و اولویت انتقال با بارهای کاری مربوط به ایمنی و هم‌راستاسازی است.