مدل DeepSeek V4 Pro رونمایی شد؛ ناامیدی در بنچمارک‌ها و درخشش در امنیت سایبری

مدل DeepSeek V4 Pro رونمایی شد؛ ناامیدی در بنچمارک‌ها و درخشش در امنیت سایبری

استارت‌آپ چینی هوش مصنوعی DeepSeek به‌تازگی نسخه به‌روزرسانی‌شده پرچمدار خود را با نام DeepSeek-V4-Pro-0813 بی‌سروصدا منتشر کرده است. اگرچه برخی توسعه‌دهندگان از قابلیت‌های عمومی و قیمت‌گذاری این مدل ناامید شده‌اند، اما توانایی‌های آن در حوزه‌های تخصصی مانند امنیت سایبری (cybersecurity) توجه پژوهشگران را به خود جلب کرده است.

با این حال، نتایج اولیه سنجش و بنچمارک (benchmark) نشان می‌دهد که این مدل پرچمدار جدید برای رقابت با رقبای سطح‌بالای خود با چالش مواجه است.

مدل DeepSeek-V4-Pro-0813 در شاخص Artificial Analysis Intelligence امتیاز ۵۳ را کسب کرده که هم‌سطح با مدل GLM-5.2 شرکت Zhipu AI (عرضه‌شده در ماه ژوئن) است. اما این مدل ۴ امتیاز از مدل میان‌رده Terra در سری جدید GPT-5.6 شرکت OpenAI و ۷ امتیاز از مدل Kimi K3 شرکت Moonshot AI عقب‌تر قرار دارد.

در شاخص Vals Index که توسط موسسه Vals AI در سان‌فرانسیسکو برای ارزیابی مدل‌ها تهیه می‌شود، مدل جدید DeepSeek در رتبه دوازدهم قرار گرفت. این مدل نه تنها از نسل قبلی OpenAI یعنی GPT-5.5 عقب ماند، بلکه فاصله زیادی با سیستم‌های پیشرو مانند Kimi K3 و Claude Opus 5 شرکت Anthropic داشت.

به گفته Vals AI، این مدل به‌ویژه در دو حوزه عملکرد ضعیفی داشته است: انجام وظایف در محیط ترمینال ایزوله‌شده (sandboxed terminal environment) و ساخت مدل‌های مالی پیچیده در صفحه‌گسترده Excel.

چرا این خبر مهم است؟

مدل‌های پیشین شرکت DeepSeek به دلیل ارائه عملکردی در سطح پرچمداران با هزینه‌ای بسیار کمتر، بازار هوش مصنوعی را تکان داده بودند. عملکرد ضعیف‌تر نسخه جدید DeepSeek-V4-Pro-0813 در بنچمارک‌های استاندارد نشان می‌دهد که حفظ نرخ پیشرفت سریع در هوش مصنوعی دشوار شده است، اگرچه موفقیت آن در حوزه امنیت سایبری نشان‌دهنده حرکت مدل‌ها به سمت تخصصی‌شدن در کاربردهای خاص است.