فناوری و هوش مصنوعی

آشنایی با معماری Qwen 3.8-Flash-Next در علی‌بابا

علی‌بابا مدل هوش مصنوعی Qwen 3.8-Flash-Next را با معماری مخلوطی از متخصصان معرفی کرد. این مدل ۱۲۵ میلیارد پارامتری، در هر پردازش تنها ۶ میلیارد پارامتر فعال دارد.

نمای گرافیکی از معماری هوش مصنوعی علی‌بابا
نمایش معماری جدید مدل‌های هوش مصنوعی در علی‌بابا — زومیت

تیم توسعه‌دهنده‌ی هوش مصنوعی در شرکت علی‌بابا، مدل جدید Qwen 3.8-Flash-Next را با معماری پیشرفته‌ی «مخلوطی از متخصصان» (MoE) عرضه خواهد کرد. این ساختار به‌منزله‌ی پیش‌نمایشی رسمی از مدل نسل بعدی یعنی Qwen 4 طراحی شده است تا توسعه‌دهندگان پیش از عرضه‌ی پرچمدار اصلی، با ساختار فنی آن آشنا شوند.

جزئیات فنی و عملکرد

اطلاعات ارائه‌شده در نشست‌های پیش از انتشار نشان می‌دهد مدل مذکور در مجموع دارای ۱۲۵ میلیارد پارامتر است؛ اما در زمان پردازش هر توکن تنها ۶ میلیارد پارامتر فعال می‌شوند. این روند سبب می‌شود هزینه‌های محاسباتی پردازش تا سطح یک مدل ۶ میلیارد پارامتری کاهش یابد.

دسترسی جهانی و بنچمارک‌ها

  • تیم توسعه‌دهنده‌ی علی‌بابا Qwen 3.8-Flash-Next را مدلی چندوجهی می‌داند که دسترسی زودهنگام به قابلیت‌های فنی خانواده‌ی Qwen 4 را ممکن می‌کند.
  • وزن‌های این مدل متن‌باز پس از انتشار نهایی، علاوه‌بر پلتفرم‌های چینی در دسترس توسعه‌دهندگان سراسر جهان قرار می‌گیرد.
  • تا زمان انتشار این گزارش، بنچمارک‌های رسمی و امتیازهای عملکردی دقیق در مقایسه با سایر رقبا منتشر نشده‌اند.

مدل‌های متن‌باز با پارامترهای فعال اندک می‌توانند توانایی‌های پیشرفته‌ی محاسباتی را روی سخت‌افزارهای تجاری استاندارد اجرا کنند.

منابع گزارشبرای شفافیت و بررسی بیشتر
  1. زومیتعلی‌بابا برای نمایش قدرت هوش مصنوعی Qwen 3.8-Flash-Next آماده می‌شود↗