تیم توسعهدهنده Qwen مدل متنباز جدیدی را با نام Qwen3.8-Flash-Next منتشر کرده است. این مدل چندوجهی مبتنی بر معماری مخلوطی از متخصصان (MoE) طراحی شده و به عنوان پیشنمایشی اولیه از معماری مورد استفاده در نسخه آینده یعنی Qwen4 عمل میکند.
مدل Qwen3.8-Flash-Next با وجود ابعاد بزرگ خود که شامل ۱۲۵ میلیارد توکن است، تنها از ۶ میلیارد توکن فعال استفاده میکند. این ویژگی معماری MoE باعث افزایش چشمگیر کارایی و سرعت پردازش آن میشود. سایمون ویلیسون، پژوهشگر هوش مصنوعی، اعلام کرده که این مدل را روی سختافزار DGX Spark و با استفاده از نسخههای کوانتیزهشده Unsloth آزمایش کرده است.
ویژگیها و نسخههای آزمایششده
بر اساس بررسیهای اولیه، نسخههای مختلفی از این مدل از جمله نسخه ۷۲.۵ گیگابایتی (UD-IQ1_S) و نسخه ۷۸.۹ گیگابایتی (UD-Q2_K_XL) مورد ارزیابی قرار گرفتهاند که عملکرد موفقی را بهویژه در زمینه استدلالهای پیچیده به نمایش گذاشتهاند.