معرفی مدل متن‌باز Qwen3.8-Flash-Next؛ پیش‌نمایشی از معماری Qwen4

معرفی مدل متن‌باز Qwen3.8-Flash-Next؛ پیش‌نمایشی از معماری Qwen4

تیم توسعه‌دهنده Qwen مدل متن‌باز جدیدی را با نام Qwen3.8-Flash-Next منتشر کرده است. این مدل چندوجهی مبتنی بر معماری مخلوطی از متخصصان (MoE) طراحی شده و به عنوان پیش‌نمایشی اولیه از معماری مورد استفاده در نسخه آینده یعنی Qwen4 عمل می‌کند.

مدل Qwen3.8-Flash-Next با وجود ابعاد بزرگ خود که شامل ۱۲۵ میلیارد توکن است، تنها از ۶ میلیارد توکن فعال استفاده می‌کند. این ویژگی معماری MoE باعث افزایش چشمگیر کارایی و سرعت پردازش آن می‌شود. سایمون ویلیسون، پژوهشگر هوش مصنوعی، اعلام کرده که این مدل را روی سخت‌افزار DGX Spark و با استفاده از نسخه‌های کوانتیزه‌شده Unsloth آزمایش کرده است.

ویژگی‌ها و نسخه‌های آزمایش‌شده

بر اساس بررسی‌های اولیه، نسخه‌های مختلفی از این مدل از جمله نسخه ۷۲.۵ گیگابایتی (UD-IQ1_S) و نسخه ۷۸.۹ گیگابایتی (UD-Q2_K_XL) مورد ارزیابی قرار گرفته‌اند که عملکرد موفقی را به‌ویژه در زمینه استدلال‌های پیچیده به نمایش گذاشته‌اند.