OpenAI مدل GPT-5.6 Cyber را برای کاربردهای امنیت سایبری منتشر کرد

OpenAI مدل GPT-5.6 Cyber را برای کاربردهای امنیت سایبری منتشر کرد

شرکت OpenAI مدل جدیدی به نام GPT-5.6 Cyber را منتشر کرده است؛ مدلی آموزش‌دیده برای امور امنیت سایبری که مدل‌های عمومی به طور معمول درخواست‌های مربوط به آن را مسدود می‌کنند. این مدل در حال حاضر از طریق Daybreak Red، سطح جدیدی در برنامه محدود امنیت سایبری OpenAI، در دسترس قرار گرفته است.

در ارزیابی‌های داخلی که شامل زنجیره‌های اکسپلویت (exploit chains)، دور زدن احراز هویت (authentication bypass) و ارتقای سطح دسترسی (privilege escalation) می‌شد، مدل GPT-5.6 Cyber به ۹۵ درصد درخواست‌ها پاسخ داد. این در حالی است که مدل GPT-5.6 Sol تحت تدابیر امنیتی استاندارد خود تنها به ۱.۵ درصد و از طریق سطح محدودتر Daybreak Blue به ۲ درصد درخواست‌ها پاسخ داده است.

برنامه Daybreak شامل دو سطح با دو ماموریت مجزا است:

  • سطح Blue: به مدافعان تأییدشده امکان دسترسی به GPT-5.6 Sol را می‌دهد، در حالی که محدودیت‌های سطح سیستم برای کارهای امنیتی دفاعی حذف شده است. OpenAI این سطح را برای بررسی امنیتی کد (secure code review)، تحلیل بدافزار (malware analysis)، پاسخ به حوادث (incident response)، اعتبارسنجی وصله (patch validation) و کشف آسیب‌پذیری (vulnerability discovery) پیشنهاد می‌کند.
  • سطح Red: دسترسی به GPT-5.6 Cyber را فراهم می‌کند؛ مدلی که OpenAI آن را برای یافتن آسیب‌پذیری‌های روز صفر (zero-day vulnerabilities)، ساخت زنجیره‌های اکسپلویت و انجام سایر وظایف امنیتی پیشرفته آموزش داده است که Sol حتی پس از حذف فیلترهای سطح سیستم همچنان آن‌ها را رد می‌کند.

مستندات رابط برنامه‌نویسی کاربردی (API) شرکت OpenAI مدل daybreak-blue-latest را به عنوان نام مستعاری توصیف می‌کند که با Responses API کار کرده و از فراخوانی تابع (function calling) پشتیبانی می‌کند، اما نیازمند تأیید و تخصیص جداگانه است. حتی با دسترسی به سطح Blue، مدل Sol همچنان می‌تواند درخواست‌هایی را که دارای کاربرد دوگانه (dual-use) بالا می‌داند رد کند.

در آزمایشی از مدل‌ها خواسته شد کدی تولید کنند که بتواند هشدارهای macOS Keychain را دور بزند و کوکی‌های Chrome را رمزگشایی کند. مدل Sol هم تحت تدابیر استاندارد و هم در سطح Daybreak Blue این درخواست را رد کرد، اما GPT-5.6 Cyber از طریق سطح Red به آن پاسخ داد.

با این حال، GPT-5.6 Cyber در همه بخش‌ها از Sol برتر نبود. اگرچه این مدل در ارزیابی ExploitGym (که توانایی عامل هوش مصنوعی را در تبدیل نقاط ضعف شناخته‌شده به اکسپلویت‌های فعال در محیط ایزوله یا ساندباکس (sandbox) می‌سنجد) امتیاز بالاتری کسب کرد، اما هنگام کشف نقاط ضعف و نگارش گزارش عملکرد ضعیف‌تری نسبت به Sol داشت. OpenAI اشاره کرد که گزارش‌های Cyber معمولاً کوتاه‌تر و با جزئیات کمتر بوده است.

مدل Sol همچنین در ارزیابی ExploitBench از نظر مصرف توکن کارآمدتر بود و در شرایطی که تعداد دورهای گفتگو به ۳۰۰ محدود شده بود، عملکرد بهتری نسبت به Cyber داشت؛ البته این فاصله در ۶۰۰ دور گفتگو کاهش یافت. مدل Cyber تمایل دارد از بودجه استدلال (reasoning budget) بزرگ‌تری استفاده کند، بنابراین جلسات پژوهشی طولانی‌تر احتمالاً هزینه بیشتری خواهند داشت.

برای تیم‌های توسعه، امنیت و عملیات (DevSecOps)، این دو سطح بر اساس گردش کار تقسیم می‌شوند. سطح Blue بررسی درخواست‌های ادغام (pull request reviews)، تحلیل بدافزار و اعتبارسنجی وصله‌ها را مدیریت می‌کند. در مقابل، سطح Red وارد حوزه توسعه اکسپلویت می‌شود و احتمالاً به محیط یکپارچه‌سازی و تحویل مداوم (CI/CD)، اعتبارنامه‌ها و زنجیره تأیید مجزای خود نیاز دارد.

شرکت‌های SpecterOps و SentinelOne و Palo Alto Networks دسترسی زودهنگام به این مدل‌ها را دریافت کرده‌اند. Palo Alto Networks این مدل‌ها را از طریق سرویس Frontier AI Defense ارائه می‌دهد و SentinelOne از طریق خدمات Wayfinder Frontier AI Services دسترسی ایجاد می‌کند. به گفته OpenAI، شرکت‌های Accenture و IBM و CrowdStrike و Cisco نیز می‌توانند این مدل‌ها را در محصولات امنیتی و سرویس‌های مدیریت‌شده خود ادغام کنند.

Jared Atkinson، مدیر ارشد فناوری SpecterOps گفت: GPT-5.6 Cyber کاری را که مدل‌های قبلی پس از هفته‌ها حل نکرده بودند، در کمتر از یک روز به پایان رساند. او به توانایی این مدل در استدلال در میان محدودیت‌های واقعی اکسپلویت، بدون رد مکرر درخواست‌های مشروع اشاره کرد.

شرکت OpenAI از این مدل برای بررسی V8 (موتور جاوااسکریپت Chrome) استفاده کرد و دو آسیب‌پذیری افشانشده را یافت که می‌توانستند برای تخریب حافظه و خروج از ساندباکس هیپ V8 مورد استفاده قرار گیرند؛ گوگل این مشکل را تحت شناسه CVE-2026-15903 برطرف کرد. این مدل همچنین سه آسیب‌پذیری حیاتی در یک پایگاه داده محبوب (از جمله مسیر اجرای از راه دور کد)، حداقل ۵ آسیب‌پذیری در یک سیستم‌عامل همراه محبوب و بیش از ۴۰۰ آسیب‌پذیری احتمالی ارتقای سطح دسترسی در هسته یک سیستم‌عامل محبوب پیدا کرد. OpenAI به دلیل ادامه روند افشا، نام نرم‌افزارهای متاثر را ذکر نکرده است.

طبق چارچوب آمادگی (Preparedness Framework) شرکت OpenAI، مدل GPT-5.6 Cyber در توانمندی امنیت سایبری به سطح «بالا» (High) رسید اما پایین‌تر از آستانه «بحرانی» (Critical) باقی ماند.

انتشار این مدل سه روز پس از آن صورت می‌گیرد که OpenAI اذعان کرد مدل بعدی آن به نام Astra می‌تواند به آستانه بحرانی برسد. این شرکت برخی از کارهای داخلی مرتبط با Astra را در حین بررسی مدل تحت کنترل‌های شدیدتر متوقف کرده است.

برای کاربران Daybreak، شرکت OpenAI توصیه می‌کند عامل‌های امنیتی از سیستم‌های عملیاتی و اینترنت عمومی دور نگه داشته شوند. همچنین از مشتریانی که از Codex استفاده می‌کنند خواسته شده حالت دسترسی کامل را با بررسی خودکار (auto-review) جایگزین کنند.

متقاضیان استفاده از Daybreak باید هویت خود را تأیید کنند، نظارت را بپذیرند و تعهدنامه‌های حقوقی امضا کنند. همچنین از تاریخ ۱ سپتامبر ۲۰۲۶، حساب‌های فردی ملزم به استفاده از کلیدهای امنیت سخت‌افزاری (hardware security keys) خواهند بود.

چرا این خبر مهم است؟

عرضه مدل‌های تخصصی مانند GPT-5.6 Cyber تحولی مهم در حوزه امنیت سایبری محسوب می‌شود، چرا که قابلیت‌های تهاجمی هوش مصنوعی را در چارچوبی کنترل‌شده در اختیار متخصصان دفاعی قرار می‌دهد. این اقدام نشان‌دهنده تغییر استراتژی OpenAI در مواجهه با ابزارهای دارای کاربرد دوگانه و تلاش برای مهار خطرات ناشی از سوءاستفاده‌های سایبری است. علاوه بر این، کشف موفقیت‌آمیز آسیب‌پذیری‌های واقعی مانند موتور V8 قدرت عملیاتی مدل‌های استدلالی جدید را در حل مسائل پیچیده امنیتی به اثبات می‌رساند.

وضعیت کاربران ایرانی

دسترسی به خدمات برنامه Daybreak به دلیل نیاز به احراز هویت رسمی سازمان‌ها، پذیرش نظارت‌های حقوقی دقیق و الزامی شدن استفاده از کلیدهای امنیت سخت‌افزاری، برای متخصصان و کاربران داخل ایران امکان‌پذیر نخواهد بود. علاوه بر این، تحریم‌های بین‌المللی موجود و سیاست‌های سخت‌گیرانه OpenAI در تخصیص دسترسی به ابزارهای حساس سایبری، مانع از بهره‌مندی مستقیم توسعه‌دهندگان ایرانی از این مدل‌ها می‌شود.