تیم توسعهدهندهی هوش مصنوعی در شرکت علیبابا، مدل جدید Qwen 3.8-Flash-Next را با معماری پیشرفتهی «مخلوطی از متخصصان» (MoE) عرضه خواهد کرد. این ساختار بهمنزلهی پیشنمایشی رسمی از مدل نسل بعدی یعنی Qwen 4 طراحی شده است تا توسعهدهندگان پیش از عرضهی پرچمدار اصلی، با ساختار فنی آن آشنا شوند.
جزئیات فنی و عملکرد
اطلاعات ارائهشده در نشستهای پیش از انتشار نشان میدهد مدل مذکور در مجموع دارای ۱۲۵ میلیارد پارامتر است؛ اما در زمان پردازش هر توکن تنها ۶ میلیارد پارامتر فعال میشوند. این روند سبب میشود هزینههای محاسباتی پردازش تا سطح یک مدل ۶ میلیارد پارامتری کاهش یابد.
دسترسی جهانی و بنچمارکها
- تیم توسعهدهندهی علیبابا Qwen 3.8-Flash-Next را مدلی چندوجهی میداند که دسترسی زودهنگام به قابلیتهای فنی خانوادهی Qwen 4 را ممکن میکند.
- وزنهای این مدل متنباز پس از انتشار نهایی، علاوهبر پلتفرمهای چینی در دسترس توسعهدهندگان سراسر جهان قرار میگیرد.
- تا زمان انتشار این گزارش، بنچمارکهای رسمی و امتیازهای عملکردی دقیق در مقایسه با سایر رقبا منتشر نشدهاند.
مدلهای متنباز با پارامترهای فعال اندک میتوانند تواناییهای پیشرفتهی محاسباتی را روی سختافزارهای تجاری استاندارد اجرا کنند.