Arm از پلتفرم نیمه‌سفارشی Neoverse CSS N4 رونمایی کرد؛ تا ۱۲۸ هسته پردازشی

Arm از پلتفرم نیمه‌سفارشی Neoverse CSS N4 رونمایی کرد؛ تا ۱۲۸ هسته پردازشی

شرکت Arm از پلتفرم زیرسیستم محاسباتی نیمه‌سفارشی جدید خود با نام Neoverse CSS N4 (با نام رمز Ranger) رونمایی کرد. این پلتفرم که بر پایه فناوری ساخت ۳ نانومتری N3P شرکت TSMC توسعه یافته است، امکان قرارگیری حداکثر ۱۲۸ هسته پردازشی را در هر دای (Die) فراهم می‌کند و هدف آن ارتقای کارایی در مراکز داده ابری است. پلتفرم‌های سری CSS به مشتریان اجازه می‌دهند تا با استفاده از مالکیت معنوی (IP) شرکت Arm، تراشه‌های اختصاصی خود را با تنظیم تعداد هسته‌ها، حافظه کش و درگاه‌های ارتباطی طراحی کنند.

مشخصات فنی و مقایسه با نسل قبل

پلتفرم Neoverse CSS N4 از ۸ تا ۱۲۸ هسته پردازشی Neoverse N4 (با نام رمز Dionysus) با فرکانس کاری حداکثر ۳.۸ گیگاهرتز پشتیبانی می‌کند. این پلتفرم مجهز به حداکثر ۲۵۶ مگابایت حافظه کش سطح سوم (L3) در هر دای، ۲ مگابایت کش L2 به ازای هر هسته و حافظه‌های DDR5 یا LPDDR6 است. در بخش اتصالات نیز پشتیبانی از حداکثر ۱۲۸ مسیر ارتباطی PCIe 7/6 و استاندارد CXL 4.0 در نظر گرفته شده است. این مشخصات ارتقای چشمگیری نسبت به پلتفرم CSS N2 به شمار می‌رود که تنها از ۶۴ هسته، ۶۴ مگابایت کش L3 و ۶۴ مسیر PCIe 5.0/CXL پشتیبانی می‌کرد.

عملکرد و جایگاه هسته‌های سری N

طبق ادعای Arm، پلتفرم Neoverse CSS N4 در مقایسه با Neoverse N3 تا دو برابر عملکرد سوکت بهتر، ۱.۲۵ برابر بازدهی مصرف انرژی بیشتر (عملکرد به ازای وات) و ۱.۷۵ برابر پهنای باند حافظه بالاتری ارائه می‌دهد. هسته‌های سری N شرکت Arm معمولاً برای بهینه‌سازی مصرف انرژی طراحی می‌شوند و در شتاب‌دهنده‌ها یا بارهای کاری ابری سبک‌تر (مانند تراشه Azure Cobalt 100 مایکروسافت) به کار می‌روند؛ در حالی که هسته‌های سری V برای دستیابی به حداکثر توان پردازشی توسعه می‌یابند.

توسعه به‌کارگیری تراشه اختصاصی AGI

هم‌زمان با این معرفی، Arm از گسترش به‌کارگیری تراشه اختصاصی خود موسوم به AGI خبر داد که با هسته‌های Neoverse V3 ساخته شده است. شرکت‌های Oracle و ByteDance به جمع مشتریان این تراشه (شامل Meta، OpenAI، Lenovo و Cloudflare) پیوسته‌اند. تراشه AGI یک پردازنده دو دای با حداکثر ۱۳۶ هسته و ۲۷۲ مگابایت کش L3 است که به دلیل ادغام حافظه و ورودی/خروجی روی یک دای مشترک، تاخیر حافظه زیر ۱۰۰ نانوثانیه را ارائه می‌دهد.