پرش به محتوا
هوش مصنوعی

مدل GLM-5.3 شرکت Z.ai در تست امنیت سایبری از Mythos و GPT-5.6 جلو زد

شرکت چینی Zhipu مدل جدیدش را داد بدون اینکه مدل پایه را عوض کند. تمام پیشرفت از post-training آمده. نمره‌ی ۸۴.۵ در CyberGym بالاتر از Mythos آنتروپیک و GPT-5.6 Sol است، اما وزن‌ها دو هفته دیرتر می‌آیند.

تحریریه زاوینو۲ دقیقه مطالعه

Read this story in English

مدل GLM-5.3 شرکت Z.ai در تست امنیت سایبری از Mythos و GPT-5.6 جلو زد

شرکت چینی Zhipu، که محصولاتش را با برند Z.ai می‌شناسیم، چهاردهم آگوست مدل GLM-5.3 را منتشر کرد.

نکته‌ی عجیب ماجرا این است که مدل پایه اصلاً عوض نشده. همان معماری MoE با ۷۴۳ میلیارد پارامتر GLM-5.2 است.

پس چه چیزی عوض شده؟

فقط post-training. یعنی همان مرحله‌ای که بعد از آموزش اصلی، مدل را برای کارهای مشخص تنظیم می‌کند.

ادعای Z.ai این است که توانایی کدنویسی مدل ۵۰٪ بهتر شده و روی بنچمارک داخلی خودشان بالاترین نمره را بین مدل‌های open-weights گرفته.

این خودش یک حرف فنی مهم است: در سال ۲۰۲۶ لزوماً برای جهش کیفی نباید مدل پایه‌ی جدید بسازی. می‌شود سرمایه را روی مرحله‌ی بعد گذاشت.

بخش امنیتی، خبر اصلی است

نمره‌ای که بیشتر از همه سر و صدا کرده مربوط به CyberGym است؛ بنچمارکی که می‌سنجد مدل تا چه حد می‌تواند از روی سورس‌کد، آسیب‌پذیری امنیتی پیدا و تأیید کند.

مدل GLM-5.3 نمره‌ی ۸۴.۵٪ گرفته. برای مقایسه، Mythos آنتروپیک ۸۳.۸٪ و GPT-5.6 Sol شرکت OpenAI ۸۳.۶٪ گرفته‌اند.

این اعداد را خود Zhipu اعلام کرده و هنوز توسط شخص ثالث تأیید نشده، ولی فاصله‌ها آن‌قدر کم است که خودش پیام دارد.

عدد دیگری هم هست که بهتر ماجرا را نشان می‌دهد، و کنار آزمایش ۴۵ ایجنتی آنتروپیک بهتر فهمیده می‌شود: از زمان GLM-5.2 تا حالا، مدل‌های Z.ai مجموعاً ۲۴۳۶ آسیب‌پذیری در ۲۶۹ پروژه‌ی متن‌باز پیدا کرده‌اند که ۱۰۹۷ موردش بحرانی یا پرخطر بوده.

وزن‌ها دیرتر می‌آیند

برخلاف نسخه‌های قبلی این خانواده، وزن‌ها همزمان با مدل منتشر نشدند. Z.ai گفته دو هفته بعد می‌آیند.

این اولین بار در خط GLM-5 است که چنین تأخیری اتفاق می‌افتد، و با توجه به اینکه نقطه‌ی قوت مدل کشف آسیب‌پذیری است، دلیلش احتمالاً چندان مرموز نیست.

مدلی که می‌تواند باگ امنیتی پیدا کند، همان مدلی است که می‌تواند از باگ امنیتی سوءاستفاده کند. 🔍

منابع

هم‌رسانی

خبرهای مرتبط

همه
علی‌بابا وزن‌های مدل ۲.۴ تریلیون پارامتری Qwen3.8-Max را آزاد کرد
هوش مصنوعی

علی‌بابا وزن‌های مدل ۲.۴ تریلیون پارامتری Qwen3.8-Max را آزاد کرد

برای اولین بار یک مدل رده‌ی Max از خانواده‌ی Qwen وزن‌هایش عمومی شد. مدل ۲.۴ تریلیون پارامتر دارد ولی در هر پرسش فقط ۹۵ میلیارد پارامتر فعال می‌شود. مشکل اینجاست که تقریباً هیچ‌کس سخت‌افزار اجرایش را ندارد.

خبرنامه

هر هفته مهم‌ترین اتفاق‌های هوش مصنوعی و تکنولوژی، خلاصه و بدون حاشیه، در ایمیلت.

هر وقت خواستی می‌توانی لغو عضویت کنی.