شرکت OpenAI مدل جدیدی به نام GPT-5.6 Cyber را منتشر کرده است؛ مدلی آموزشدیده برای امور امنیت سایبری که مدلهای عمومی به طور معمول درخواستهای مربوط به آن را مسدود میکنند. این مدل در حال حاضر از طریق Daybreak Red، سطح جدیدی در برنامه محدود امنیت سایبری OpenAI، در دسترس قرار گرفته است.
در ارزیابیهای داخلی که شامل زنجیرههای اکسپلویت (exploit chains)، دور زدن احراز هویت (authentication bypass) و ارتقای سطح دسترسی (privilege escalation) میشد، مدل GPT-5.6 Cyber به ۹۵ درصد درخواستها پاسخ داد. این در حالی است که مدل GPT-5.6 Sol تحت تدابیر امنیتی استاندارد خود تنها به ۱.۵ درصد و از طریق سطح محدودتر Daybreak Blue به ۲ درصد درخواستها پاسخ داده است.
برنامه Daybreak شامل دو سطح با دو ماموریت مجزا است:
- سطح Blue: به مدافعان تأییدشده امکان دسترسی به GPT-5.6 Sol را میدهد، در حالی که محدودیتهای سطح سیستم برای کارهای امنیتی دفاعی حذف شده است. OpenAI این سطح را برای بررسی امنیتی کد (secure code review)، تحلیل بدافزار (malware analysis)، پاسخ به حوادث (incident response)، اعتبارسنجی وصله (patch validation) و کشف آسیبپذیری (vulnerability discovery) پیشنهاد میکند.
- سطح Red: دسترسی به GPT-5.6 Cyber را فراهم میکند؛ مدلی که OpenAI آن را برای یافتن آسیبپذیریهای روز صفر (zero-day vulnerabilities)، ساخت زنجیرههای اکسپلویت و انجام سایر وظایف امنیتی پیشرفته آموزش داده است که Sol حتی پس از حذف فیلترهای سطح سیستم همچنان آنها را رد میکند.
مستندات رابط برنامهنویسی کاربردی (API) شرکت OpenAI مدل daybreak-blue-latest را به عنوان نام مستعاری توصیف میکند که با Responses API کار کرده و از فراخوانی تابع (function calling) پشتیبانی میکند، اما نیازمند تأیید و تخصیص جداگانه است. حتی با دسترسی به سطح Blue، مدل Sol همچنان میتواند درخواستهایی را که دارای کاربرد دوگانه (dual-use) بالا میداند رد کند.
در آزمایشی از مدلها خواسته شد کدی تولید کنند که بتواند هشدارهای macOS Keychain را دور بزند و کوکیهای Chrome را رمزگشایی کند. مدل Sol هم تحت تدابیر استاندارد و هم در سطح Daybreak Blue این درخواست را رد کرد، اما GPT-5.6 Cyber از طریق سطح Red به آن پاسخ داد.
با این حال، GPT-5.6 Cyber در همه بخشها از Sol برتر نبود. اگرچه این مدل در ارزیابی ExploitGym (که توانایی عامل هوش مصنوعی را در تبدیل نقاط ضعف شناختهشده به اکسپلویتهای فعال در محیط ایزوله یا ساندباکس (sandbox) میسنجد) امتیاز بالاتری کسب کرد، اما هنگام کشف نقاط ضعف و نگارش گزارش عملکرد ضعیفتری نسبت به Sol داشت. OpenAI اشاره کرد که گزارشهای Cyber معمولاً کوتاهتر و با جزئیات کمتر بوده است.
مدل Sol همچنین در ارزیابی ExploitBench از نظر مصرف توکن کارآمدتر بود و در شرایطی که تعداد دورهای گفتگو به ۳۰۰ محدود شده بود، عملکرد بهتری نسبت به Cyber داشت؛ البته این فاصله در ۶۰۰ دور گفتگو کاهش یافت. مدل Cyber تمایل دارد از بودجه استدلال (reasoning budget) بزرگتری استفاده کند، بنابراین جلسات پژوهشی طولانیتر احتمالاً هزینه بیشتری خواهند داشت.
برای تیمهای توسعه، امنیت و عملیات (DevSecOps)، این دو سطح بر اساس گردش کار تقسیم میشوند. سطح Blue بررسی درخواستهای ادغام (pull request reviews)، تحلیل بدافزار و اعتبارسنجی وصلهها را مدیریت میکند. در مقابل، سطح Red وارد حوزه توسعه اکسپلویت میشود و احتمالاً به محیط یکپارچهسازی و تحویل مداوم (CI/CD)، اعتبارنامهها و زنجیره تأیید مجزای خود نیاز دارد.
شرکتهای SpecterOps و SentinelOne و Palo Alto Networks دسترسی زودهنگام به این مدلها را دریافت کردهاند. Palo Alto Networks این مدلها را از طریق سرویس Frontier AI Defense ارائه میدهد و SentinelOne از طریق خدمات Wayfinder Frontier AI Services دسترسی ایجاد میکند. به گفته OpenAI، شرکتهای Accenture و IBM و CrowdStrike و Cisco نیز میتوانند این مدلها را در محصولات امنیتی و سرویسهای مدیریتشده خود ادغام کنند.
Jared Atkinson، مدیر ارشد فناوری SpecterOps گفت: GPT-5.6 Cyber کاری را که مدلهای قبلی پس از هفتهها حل نکرده بودند، در کمتر از یک روز به پایان رساند. او به توانایی این مدل در استدلال در میان محدودیتهای واقعی اکسپلویت، بدون رد مکرر درخواستهای مشروع اشاره کرد.
شرکت OpenAI از این مدل برای بررسی V8 (موتور جاوااسکریپت Chrome) استفاده کرد و دو آسیبپذیری افشانشده را یافت که میتوانستند برای تخریب حافظه و خروج از ساندباکس هیپ V8 مورد استفاده قرار گیرند؛ گوگل این مشکل را تحت شناسه CVE-2026-15903 برطرف کرد. این مدل همچنین سه آسیبپذیری حیاتی در یک پایگاه داده محبوب (از جمله مسیر اجرای از راه دور کد)، حداقل ۵ آسیبپذیری در یک سیستمعامل همراه محبوب و بیش از ۴۰۰ آسیبپذیری احتمالی ارتقای سطح دسترسی در هسته یک سیستمعامل محبوب پیدا کرد. OpenAI به دلیل ادامه روند افشا، نام نرمافزارهای متاثر را ذکر نکرده است.
طبق چارچوب آمادگی (Preparedness Framework) شرکت OpenAI، مدل GPT-5.6 Cyber در توانمندی امنیت سایبری به سطح «بالا» (High) رسید اما پایینتر از آستانه «بحرانی» (Critical) باقی ماند.
انتشار این مدل سه روز پس از آن صورت میگیرد که OpenAI اذعان کرد مدل بعدی آن به نام Astra میتواند به آستانه بحرانی برسد. این شرکت برخی از کارهای داخلی مرتبط با Astra را در حین بررسی مدل تحت کنترلهای شدیدتر متوقف کرده است.
برای کاربران Daybreak، شرکت OpenAI توصیه میکند عاملهای امنیتی از سیستمهای عملیاتی و اینترنت عمومی دور نگه داشته شوند. همچنین از مشتریانی که از Codex استفاده میکنند خواسته شده حالت دسترسی کامل را با بررسی خودکار (auto-review) جایگزین کنند.
متقاضیان استفاده از Daybreak باید هویت خود را تأیید کنند، نظارت را بپذیرند و تعهدنامههای حقوقی امضا کنند. همچنین از تاریخ ۱ سپتامبر ۲۰۲۶، حسابهای فردی ملزم به استفاده از کلیدهای امنیت سختافزاری (hardware security keys) خواهند بود.
چرا این خبر مهم است؟
عرضه مدلهای تخصصی مانند GPT-5.6 Cyber تحولی مهم در حوزه امنیت سایبری محسوب میشود، چرا که قابلیتهای تهاجمی هوش مصنوعی را در چارچوبی کنترلشده در اختیار متخصصان دفاعی قرار میدهد. این اقدام نشاندهنده تغییر استراتژی OpenAI در مواجهه با ابزارهای دارای کاربرد دوگانه و تلاش برای مهار خطرات ناشی از سوءاستفادههای سایبری است. علاوه بر این، کشف موفقیتآمیز آسیبپذیریهای واقعی مانند موتور V8 قدرت عملیاتی مدلهای استدلالی جدید را در حل مسائل پیچیده امنیتی به اثبات میرساند.
وضعیت کاربران ایرانی
دسترسی به خدمات برنامه Daybreak به دلیل نیاز به احراز هویت رسمی سازمانها، پذیرش نظارتهای حقوقی دقیق و الزامی شدن استفاده از کلیدهای امنیت سختافزاری، برای متخصصان و کاربران داخل ایران امکانپذیر نخواهد بود. علاوه بر این، تحریمهای بینالمللی موجود و سیاستهای سختگیرانه OpenAI در تخصیص دسترسی به ابزارهای حساس سایبری، مانع از بهرهمندی مستقیم توسعهدهندگان ایرانی از این مدلها میشود.