شرکت چینی هوش مصنوعی Zhipu که با نام Z.ai نیز شناخته میشود، مدل پرچمدار خود به نام GLM-5.3 را معرفی کرد. این شرکت مدعی شده است که مدل جدیدش در آزمون امنیت سایبری CyberGym، عملکرد بهتری نسبت به مدلهای پیشرفته آمریکایی مانند Mythos 5 از شرکت Anthropic و GPT-5.6 Sol از OpenAI داشته است.
طبق اعلام Zhipu، مدل GLM-5.3 موفق به کسب نرخ موفقیت ۸۴.۵ درصد در آزمون CyberGym شده است. این آزمون توانایی مدلها در شناسایی و تأیید آسیبپذیریهای امنیتی در کدهای منبع را میسنجد. این نرخ موفقیت بالاتر از Mythos 5 با ۸۳.۸ درصد و GPT-5.6 Sol با ۸۳.۶ درصد است.
با این حال، مدل چینی در آزمون دیگری به نام ExploitBench که میزان توانایی مدلها در بهرهبرداری از آسیبپذیریها را اندازهگیری میکند، نتوانست عملکرد رقبا را تکرار کند. نرخ موفقیت GLM-5.3 در این آزمون ۵۴.۴ درصد بود که پایینتر از Mythos 5 با ۷۸ درصد و GPT-5.6 Sol با ۷۶.۵ درصد قرار گرفت.
Zhipu همچنین اعلام کرد که مدل GLM-5.3 را در همکاری با تیمهای امنیتی در چین بر روی کدهای واقعی آزمایش کرده است. این آزمایش منجر به شناسایی ۲۴۳۶ آسیبپذیری در ۲۶۹ پروژه مختلف شد که پس از بررسی کارشناسان، ۱۰۹۷ مورد از آنها در دسته آسیبپذیریهای با شدت متوسط تا بالا قرار گرفتند.
چرا این خبر مهم است؟
این خبر نشاندهنده پیشرفتهای چین در حوزه هوش مصنوعی امنیتی است و رقابت فزایندهای را با شرکتهای آمریکایی در این زمینه برجسته میکند. موفقیت مدل GLM-5.3 در آزمون CyberGym میتواند تأثیر قابل توجهی بر توسعه ابزارهای امنیتی مبتنی بر هوش مصنوعی داشته باشد. با این حال، عملکرد ضعیفتر در آزمون ExploitBench نشان میدهد که هنوز فاصلهای با مدلهای غربی وجود دارد.