پرش به محتوا
هوش مصنوعی

وزن‌های باز Qwen3.8-27B با Apache 2.0؛ ۱۷ گیگابایت برای اجرای محلی

علی‌بابا Qwen3.8-27B را با لایسنس Apache 2.0 آزاد کرد: ۲۷ میلیارد پارامتر، ۲۶۲ هزار توکن متن بومی و حدود ۱۷ گیگابایت برای اجرای محلی. همین عدد آخر، جواب ادعای «فرانتیر روی گوشی» است.

تحریریه زاوینو۳ دقیقه مطالعه

Read this story in English

وزن‌های باز Qwen3.8-27B علی‌بابا روی لپ‌تاپ و گوشی، کنار نشان لایسنس Apache 2.0

شرکت Alibaba روز ۱۴ آگوست وزن‌های Qwen3.8-27B را با لایسنس Apache 2.0 بیرون داد: یک مدل dense با ۲۷ میلیارد پارامتر و پنجره‌ی متنی بومی ۲۶۲ هزار توکن که تا یک میلیون توکن باز می‌شه. خود تیم Qwen نوشته اجرای محلی حدود ۱۷ گیگابایت می‌خواد، و همین یک عدد جلوی تیتری که می‌گه فرانتیر رفته توی گوشی می‌ایسته.

چه چیزی واقعاً آزاد شد

پلتفرم Alibaba Cloud فایل‌های لازم برای میزبانی سری جدید مدل‌های multimodal روی زیرساخت خصوصی را در اختیار توسعه‌دهنده‌ها و سازنده‌های سخت‌افزار گذاشته. نسخه‌ی ۲۷ میلیاردی برای کدنویسی واقعی و کارهای اداری تنظیم شده و لایسنس Apache 2.0 روی همین فایل‌ها نشسته. همان روز وزن‌های مدل بزرگ‌تر Qwen3.8 2.4T A95B هم آزاد شد، که آزادسازی وزن‌های ۲.۴ تریلیون پارامتری Qwen3.8-Max را جداگانه پوشش داده بودیم.

شرکت MediaTek از روز صفر از مدل ۲۷ میلیاردی روی SoC پرچم‌دار موبایل Dimensity و روی Auto Cockpit C-X1 پشتیبانی می‌کنه، با این هدف که ایجنت‌ها داخل گوشی و خودرو اجرا بشن. بقیه‌ی شرکای عرضه سه جای دیگری را پوشش می‌دن که وزن‌ها آن‌جا اجرا می‌شن: LM Studio برای لپ‌تاپ، Nvidia RTX Spark برای توسعه‌دهنده‌ی محلی و Cerebras برای سرور اختصاصی، با وعده‌ی حضور روی Shared Tier در آینده‌ی نزدیک.

نسخه‌ی روز جمعه‌ی همین خبر تیتر دیگری داشت: این‌که Qwen3.8-27B در بنچمارک‌های ایجنتی از Claude Opus 4.6 Max جلو زده. در متنی که به دست ما رسیده هیچ عددی پشت آن ادعا نیست؛ نه جدول، نه نام بنچمارک، نه امتیاز. راهنمای خواندن جدول بنچمارک دقیقاً برای همین حالت نوشته شده، جایی که ادعا هست و ستون نیست.

چرا این خبر برای کاربر ایرانی جنس دیگری داره

وزن باز تنها شکلی از مدل جدی است که بدون حساب کاربری، بدون کارت و بدون درگاه پرداخت به دست کاربر می‌رسه. وقتی فایل روی دیسک خودت باشه، اجرای مدل هیچ تماسی با API نمی‌گیره، پس هیچ لایه‌ای هم برای بستن دسترسی باقی نمی‌مونه. مشکل یک قدم عقب‌تر است: قبل از هر اجرای آفلاین، یک دانلود آنلاین باید اتفاق بیفته، و میزبان همان Hugging Face و Alibaba Cloud هستند که خودشان دروازه دارند. آفلاین بودنِ مرحله‌ی دوم، آنلاین بودنِ مرحله‌ی اول را حذف نمی‌کنه.

عدد ۱۷ گیگابایت هم ارزش حساب کردن داره. ۲۷ میلیارد پارامتر با دقت ۱۶ بیتی چیزی نزدیک ۵۴ گیگابایت وزن خالص می‌شه، پس ۱۷ گیگابایت یعنی نسخه‌ی فشرده. منبع نگفته کدام سطح کوانتیزیشن، نگفته چند توکن در ثانیه، و نگفته آن ۱۷ گیگ در چه طول متنی اندازه گرفته شده؛ حافظه‌ای که پنجره‌ی ۲۶۲ هزار توکنی مصرف می‌کنه روی همین رقم اضافه می‌شه، نه داخلش. برای یک لپ‌تاپ با رم کافی این عدد شدنی است، برای گوشی‌ای که همین حالا در جیب کسی است نه. الگوی این چند ماه را در بایگانی مدل‌های هوش مصنوعی زاوینو می‌شه دنبال کرد.

طرف دیگر ماجرا

مدلی که در ۱۷ گیگابایت جا می‌شه، به معنای دقیق کلمه مدل فرانتیر نیست، و بهترین شاهدش خود همین عرضه است: Alibaba هم‌زمان وزن‌های ۲.۴ تریلیون پارامتری A95B را هم داد. اگر نسخه‌ی کوچک همان کار را می‌کرد، نسخه‌ی بزرگ دلیلی برای وجود نداشت.

پشتیبانی روز صفر هم ادعای سازنده‌ی چیپ است، نه گزارش اجرای مدل روی گوشی‌ای که در بازار است. همان بخشی که کل تیتر روی آن سوار شده، تنها بخشی است که سنجش‌پذیر منتشر نشده؛ فاصله‌ی تیتر و جدول در عرضه‌ی Grok 4.6 هم دقیقاً همین شکل بود.

لایسنس Apache 2.0 قوی‌ترین بخش این خبر است، چون برخلاف مجوزهای اختصاصی‌ای که بعضی آزمایشگاه‌ها اسمش را وزن باز می‌گذارند، شرط شرکتی و سقف کاربر ندارد. با این حال متن کامل فایل مجوزی که روی مخزن نشسته در این منبع نیست، و قبل از هر استقرار تجاری همان فایل LICENSE تنها چیزی است که ارزش خواندن دارد. عددی هم که باید منتظرش بود یکی بیشتر نیست: توکن بر ثانیه روی یک Dimensity واقعی، از دست کسی که Alibaba برایش دموی صحنه نساخته. 👀

سوال‌های پرتکرار

مدل Qwen3.8-27B واقعاً روی گوشی اجرا می‌شه؟

هنوز معلوم نیست. چیزی که اعلام شده پشتیبانی روز صفر MediaTek روی SoC پرچم‌دار Dimensity و Auto Cockpit C-X1 است، یعنی آمادگی چیپ، نه گزارش اجرای مدل روی یک گوشی موجود در بازار. در متن عرضه نه نام دستگاه هست، نه میزان رم آن، نه عدد توکن بر ثانیه. تنها عدد رسمی، همان حدود ۱۷ گیگابایت برای اجرای محلی است.

برای اجرای محلی Qwen3.8-27B چقدر حافظه لازمه؟

تیم Qwen حدود ۱۷ گیگابایت اعلام کرده. این رقم برای وزن‌های فشرده‌شده است، چون ۲۷ میلیارد پارامتر با دقت ۱۶ بیتی چیزی نزدیک ۵۴ گیگابایت می‌شد. منبع نگفته کدام سطح کوانتیزیشن و در چه طول متنی این عدد اندازه گرفته شده، و حافظه‌ای که پنجره‌ی ۲۶۲ هزار توکنی مصرف می‌کنه روی همین رقم اضافه می‌شه.

استفاده‌ی تجاری از Qwen3.8-27B آزاده؟

لایسنس اعلام‌شده Apache 2.0 است، یعنی همان مجوزی که استفاده‌ی تجاری، تغییر و توزیع مجدد را اجازه می‌ده و شرط سقف کاربر یا محدودیت شرکتی ندارد. متن کامل فایل مجوزی که روی مخزن نشسته در این منبع نیامده، پس قبل از استقرار تجاری، خواندن فایل LICENSE خود مخزن تنها راه مطمئن است.

منابع

هم‌رسانی

خبرهای مرتبط

همه
علی‌بابا وزن‌های مدل ۲.۴ تریلیون پارامتری Qwen3.8-Max را آزاد کرد
هوش مصنوعی

علی‌بابا وزن‌های مدل ۲.۴ تریلیون پارامتری Qwen3.8-Max را آزاد کرد

برای اولین بار یک مدل رده‌ی Max از خانواده‌ی Qwen وزن‌هایش عمومی شد. مدل ۲.۴ تریلیون پارامتر دارد ولی در هر پرسش فقط ۹۵ میلیارد پارامتر فعال می‌شود. مشکل اینجاست که تقریباً هیچ‌کس سخت‌افزار اجرایش را ندارد.

خبرنامه

هر هفته مهم‌ترین اتفاق‌های هوش مصنوعی و تکنولوژی، خلاصه و بدون حاشیه، در ایمیلت.

هر وقت خواستی می‌توانی لغو عضویت کنی.