پرش به محتوا
هوش مصنوعی

۳ میلیارد دانلود Qwen در شش ماه؛ عبور از Meta اما روی شمار مشتق‌هاست نه دانلود

مدل‌های Qwen در نیم سال از ۳ میلیارد دانلود رد شدند و Hugging Face ۱۵۱٬۴۴۸ مشتق از آن‌ها شمرد. تیترها این را عبور از Meta خواندند، ولی آن مقایسه روی شمار مدل‌های مشتق‌شده بوده نه روی دانلود.

تحریریه زاوینو۳ دقیقه مطالعه

Read this story in English

نمای صفحه‌ی مدل‌های Qwen روی Hugging Face، جایی که ۳ میلیارد دانلود Qwen در شش ماه ثبت شده

خانواده‌ی مدل‌های Qwen شرکت Alibaba در شش ماه گذشته از ۳ میلیارد دانلود رد شده و پلتفرم Hugging Face تا ۱۵ آگوست ۱۵۱٬۴۴۸ مدل مشتق‌شده از آن شمرده، ۲.۶ برابر کل ردپای Meta و ۴.۷ برابر مخزن‌های Llama. با همین دو عدد، Qwen حالا پرمصرف‌ترین خانواده‌ی مدل وزن‌باز دنیاست.

آنچه گزارش می‌گوید

گزارش روز شنبه دو سنجه‌ی جدا را کنار هم گذاشته. اولی حجم دانلود است، بیش از ۳ میلیارد بار در نیم سال. دومی شمار مشتق‌هاست: ۱۵۱٬۴۴۸ مخزن روی Hugging Face که پایه‌شان Qwen است، در برابر کل ردپای Meta و در برابر مخزن‌های Llama.

نکته‌ای که در بازنشر تیترها گم می‌شود همین‌جاست. عبارت عبور از Meta از مقایسه‌ی دانلود بیرون نیامده، از مقایسه‌ی شمار مشتق‌ها بیرون آمده. در متن اصلی هیچ عدد دانلودی برای Meta یا Alphabet نیامده که بشود ۳ میلیارد را کنارش گذاشت. حتی همان مقایسه‌ی مشتق‌ها هم وسط راه مخرجش عوض می‌شود، یک‌بار کل ردپای Meta و یک‌بار فقط مخزن‌های Llama، که دو چیز یکسان نیستند.

پشت این عددها یک عرضه‌ی تازه هم هست. یک روز قبل وزن‌های باز Qwen3.8-27B با نیاز حدوداً ۱۷ گیگابایتی برای اجرای محلی منتشر شده بود، با پشتیبانی روز صفر روی Dimensity Auto Cockpit C-X1 و آخرین SoC پرچم‌دار موبایل Dimensity. شرکت Cerebras هم گفته این مدل به‌زودی روی Shared Tier می‌آید.

چرا برای شما فرق می‌کند

اگر کارت بانکی‌تان روی API های آمریکایی کار نمی‌کند، این خبر یک معنای عملی دارد که برای توسعه‌دهنده‌ی آن‌طرف آب ندارد: وزنی که دانلود می‌شود به کلید API، به صورت‌حساب دلاری و به تأیید هویت احتیاج ندارد. همان ۱۷ گیگابایت یعنی مدل روی یک کارت گرافیک معمولی بالا می‌آید و ورودی شما از دستگاه خودتان بیرون نمی‌رود.

اثر دوم را باید در آن ۱۵۱ هزار مشتق دید. وقتی این‌همه آدم روی یک پایه کار می‌کنند، نسخه‌ی کوانتایز، اسکریپت سرو و راه‌حل خطاهای رایج از قبل نوشته شده و شما اولین کسی نیستید که به آن مشکل برمی‌خورد. همین اثر شبکه‌ای است که آزادسازی وزن‌های Qwen3.8-Max با ۲.۴ تریلیون پارامتر را از یک خبر شرکتی به یک تصمیم فنی برای کاربر تبدیل می‌کند.

طرف دیگر ماجرا

دانلود، مصرف نیست. یک عدد ۳ میلیاردی هر pull در CI، هر آینه‌ی داخلی، هر بار کشیدن دوباره‌ی همان فایل و هر مشتق کوچک را با هم جمع می‌کند و بین یک سرویس زنده و یک نوت‌بوک رهاشده فرقی نمی‌گذارد. ساختن مخزن مشتق هم گران نیست، چون یک fine-tune کوچک یا حتی یک بازآپلود کوانتایز‌شده همان یک واحد را به آن ۱۵۱ هزار اضافه می‌کند.

مقایسه‌ی برند به برند هم لنگ می‌زند. مدل‌های Meta و Google از مسیرهای دیگری هم توزیع می‌شوند و آن مسیرها در شمارش Hugging Face نمی‌آیند. هیچ‌جا هم توضیح نداده‌اند که دانلود را چطور شمرده‌اند. درست مثل خواندن جدول‌های بنچمارک، سؤال درست این است که چه چیزی شمرده شده، نه اینکه کدام عدد بزرگ‌تر است. بقیه‌ی پوشش هوش مصنوعی ما همین سؤال را دنبال می‌کند. 👀

سوال‌های پرتکرار

۳ میلیارد دانلود Qwen دقیقاً چه چیزی را نشان می‌دهد؟

این عدد مجموع دفعاتی است که فایل‌های وزن Qwen در شش ماه از مخزن‌ها کشیده شده، نه شمار کاربران و نه شمار سرویس‌های زنده. یک pull خودکار در CI، یک آینه‌ی داخلی و دانلود دوباره‌ی همان فایل، همه در همین یک رقم جمع می‌شوند. پس عدد بزرگ نشانه‌ی توجه توسعه‌دهنده‌هاست، نه اندازه‌ی مصرف واقعی در محصول نهایی.

آیا Qwen واقعاً از Meta جلو زده؟

در سنجه‌ای که گزارش شده بله، ولی آن سنجه دانلود نیست. مقایسه روی شمار مدل‌های مشتق‌شده در Hugging Face انجام شده: ۱۵۱٬۴۴۸ مخزن مبتنی بر Qwen، یعنی ۲.۶ برابر کل ردپای Meta و ۴.۷ برابر مخزن‌های Llama. عدد دانلود Meta در متن اصلی نیامده، پس تیترهایی که ۳ میلیارد دانلود را دلیل عبور از Meta می‌دانند دو سنجه‌ی متفاوت را قاطی کرده‌اند.

برای اجرای محلی Qwen3.8-27B چقدر حافظه لازم است؟

حدود ۱۷ گیگابایت، بر اساس اعلام خود تیم Qwen. با این رقم، مدل روی یک کارت گرافیک رده‌بالای مصرفی یا دستگاهی با حافظه‌ی یکپارچه‌ی کافی بالا می‌آید و به کلید API و صورت‌حساب دلاری احتیاج ندارد. همین نسخه پشتیبانی روز صفر روی Dimensity Auto Cockpit C-X1 و آخرین SoC پرچم‌دار موبایل Dimensity دارد.

منابع

هم‌رسانی

خبرهای مرتبط

همه
علی‌بابا وزن‌های مدل ۲.۴ تریلیون پارامتری Qwen3.8-Max را آزاد کرد
هوش مصنوعی

علی‌بابا وزن‌های مدل ۲.۴ تریلیون پارامتری Qwen3.8-Max را آزاد کرد

برای اولین بار یک مدل رده‌ی Max از خانواده‌ی Qwen وزن‌هایش عمومی شد. مدل ۲.۴ تریلیون پارامتر دارد ولی در هر پرسش فقط ۹۵ میلیارد پارامتر فعال می‌شود. مشکل اینجاست که تقریباً هیچ‌کس سخت‌افزار اجرایش را ندارد.

خبرنامه

هر هفته مهم‌ترین اتفاق‌های هوش مصنوعی و تکنولوژی، خلاصه و بدون حاشیه، در ایمیلت.

هر وقت خواستی می‌توانی لغو عضویت کنی.