هوش مصنوعی GLM-5.3 بهعنوان رقیب Kimi K3 معرفی شد
آزمایشگاه چینی هوش مصنوعی Zhipu AI یا Z.ai از جدیدترین مدل خود با نام GLM-5.3 رونمایی کرد. این مدل ۷۴۳ میلیارد پارامتری که با تمرکز بر مهارتهای برنامهنویسی، ایجنتی و امنیت سایبری توسعه یافته، از طریق پلنهای اشتراکی GLM Coding Plan و بستر ZCode در دسترس قرار گرفته است. دسترسی به API و دانلود وزنهای آزاد مدل نیز پس از ارزیابیهای امنیتی طی هفتههای آینده بهصورت مرحلهای انجام خواهد شد.
نکته قابلتوجه در توسعه GLM-5.3 این است که مانند نسخه قبلیاش ۷۴۳ میلیارد پارامتر دارد. تمامی پیشرفتها و جهشهای عملکردی در این مدل، صرفاً از طریق توسعه و مقیاسپذیری لایه پسآموزش حاصل شدهاند. به گفته پژوهشگران Z.ai، آنها بهجای افزایش حجم مدل پایه، لایه آموزشی را با افزودن محیطهای شبیهسازی بیشتر، تنوعدادن به وظایف و تخصیص توان پردازشی بالاتر برای یادگیری تعاملی ارتقا دادهاند.
توسعهدهندگان علاوهبر دقت عملکرد، بر کارایی توکنها نیز تمرکز ویژهای داشتهاند. در بنچمارک اختصاصی Z.ai Code Bench، مدل جدید با مصرف حدود ۷۵ هزار توکن خروجی به نرخ موفقیت ۳۴.۵ درصد دست یافت؛ درحالیکه مدل GLM-5.2 در همین تست با مصرف ۹۶ هزار توکن، تنها نرخ ۲۳.۴ درصد را ثبت کرده بود.
مدل هوش مصنوعی GLM-5.3
در بنچمارکهای تخصصی برنامهنویسی، مدل GLM-5.3 عملکرد قدرتمندی ثبت کرد، اگرچه همچنان در برخی شاخصها پس از رقبای تجاری پیشتاز آمریکایی قرار میگیرد. در بنچمارک Terminal Bench 3.0 که توانایی کار با محیطهای واقعی لینوکس و سیستمهای خودکار را میسنجد، GLM-5.3 به امتیاز ۲۸.۳ دست یافت که رشدی ۶ برابری نسبت به امتیاز ۴.۶ در مدل GLM-5.2 محسوب میشود؛ اما همچنان پایینتر از مدلهای بسته Claude Fable 5 با امتیاز ۳۳.۷ و GPT-5.6 Sol با امتیاز ۳۴.۶ قرار دارد.

در آزمون DeepSWE v1.1 که مربوط به رفع آسیبها و باگهای واقعی پروژههای گیتهاب است، مدل GLM-5.3 امتیاز ۶۶.۹ را ثبت کرد که رشدی ۱.۵ برابری نسبت به نسل قبل نشان میدهد، هرچند رقیب هموطن آن یعنی Kimi K3 با امتیاز ۶۷.۵ و مدل Fable 5 با امتیاز ۶۹.۷ بالاتر از آن قرار گرفتند. در کل، عملکرد GLM-5.3 نشان میدهد که این مدل نسبت به پیشینیان و برخی مدلهای متنباز همرده برتری مشهودی دارد، اما مدلهای پیشرفته بسته تجاری همچنان صدر جدول برنامهنویسی را در اختیار دارند.
بزرگترین شگفتی GLM-5.3 به حوزه امنیت سایبری مربوط میشود. این مدل با ثبت امتیاز ۸۴.۵ درصد در بنچمارک CyberGym، موفق شد بالاتر از مدلهای مطرحی مانند Claude Fable 5 با امتیاز ۸۳.۸ درصد و GPT-5.6 Sol با امتیاز ۸۳.۶ درصد در صدر جدول قرار بگیرد. همچنین توانایی این مدل در اجرای کدهای نفوذ و تحلیل امنیتی نسبت به نسل قبل بیش از ۲ برابر شده است.

آزمایشگاه Z.ai فهرستی از یافتههای امنیتی این مدل منتشر کرد که نشان میدهد GLM-5.3 موفق به شناسایی ۲,۴۳۶ آسیبپذیری نرمافزاری در ۲۶۹ پروژه متنباز شده است. از این میان، ۱,۰۹۷ مورد در رده خطر «متوسط تا بسیار بالا» دستهبندی شدهاند. جالبترین نکته، کشف رخنهای امنیتی بود که تاریخ ایجاد آن به سال ۱۹۸۱ بازمیگشت؛ باگی قدیمی که بهطور متوسط به مدت ۲۶.۶ سال از دید تمامی اسکنرها و پژوهشگران امنیتی پنهان مانده بود.
