استارتآپ چینی هوش مصنوعی DeepSeek بهتازگی نسخه بهروزرسانیشده پرچمدار خود را با نام DeepSeek-V4-Pro-0813 بیسروصدا منتشر کرده است. اگرچه برخی توسعهدهندگان از قابلیتهای عمومی و قیمتگذاری این مدل ناامید شدهاند، اما تواناییهای آن در حوزههای تخصصی مانند امنیت سایبری (cybersecurity) توجه پژوهشگران را به خود جلب کرده است.
با این حال، نتایج اولیه سنجش و بنچمارک (benchmark) نشان میدهد که این مدل پرچمدار جدید برای رقابت با رقبای سطحبالای خود با چالش مواجه است.
مدل DeepSeek-V4-Pro-0813 در شاخص Artificial Analysis Intelligence امتیاز ۵۳ را کسب کرده که همسطح با مدل GLM-5.2 شرکت Zhipu AI (عرضهشده در ماه ژوئن) است. اما این مدل ۴ امتیاز از مدل میانرده Terra در سری جدید GPT-5.6 شرکت OpenAI و ۷ امتیاز از مدل Kimi K3 شرکت Moonshot AI عقبتر قرار دارد.
در شاخص Vals Index که توسط موسسه Vals AI در سانفرانسیسکو برای ارزیابی مدلها تهیه میشود، مدل جدید DeepSeek در رتبه دوازدهم قرار گرفت. این مدل نه تنها از نسل قبلی OpenAI یعنی GPT-5.5 عقب ماند، بلکه فاصله زیادی با سیستمهای پیشرو مانند Kimi K3 و Claude Opus 5 شرکت Anthropic داشت.
به گفته Vals AI، این مدل بهویژه در دو حوزه عملکرد ضعیفی داشته است: انجام وظایف در محیط ترمینال ایزولهشده (sandboxed terminal environment) و ساخت مدلهای مالی پیچیده در صفحهگسترده Excel.
چرا این خبر مهم است؟
مدلهای پیشین شرکت DeepSeek به دلیل ارائه عملکردی در سطح پرچمداران با هزینهای بسیار کمتر، بازار هوش مصنوعی را تکان داده بودند. عملکرد ضعیفتر نسخه جدید DeepSeek-V4-Pro-0813 در بنچمارکهای استاندارد نشان میدهد که حفظ نرخ پیشرفت سریع در هوش مصنوعی دشوار شده است، اگرچه موفقیت آن در حوزه امنیت سایبری نشاندهنده حرکت مدلها به سمت تخصصیشدن در کاربردهای خاص است.