GLM-5.3 منتشر شد: مدل چینی که ادعای قویترین کدنویس متنباز دنیا رو داره
شرکت چینی Zhipu AI (که با اسم تجاری Z.ai هم شناخته میشه) چهاردهم آگوست مدل جدیدش، GLM-5.3، رو منتشر کرد. طبق ادعای خود شرکت، این مدل الان قویترین مدل کدنویسی open-weights دنیاست؛ ادعایی که هنوز بهطور مستقل تأیید نشده، ولی جزئیات فنی پشتش قابل توجهه.
بدون تغییر مدل پایه، فقط با post-training
نکتهی جالب GLM-5.3 اینه که دقیقاً همون معماری و مدل پایهی نسخهی قبلی (GLM-5.2) رو داره؛ هیچ pretraining جدیدی انجام نشده. تمام بهبودها از یه دور گستردهی post-training اومده؛ چیزی که Zhipu توضیح میده با استفاده از دهها برابر بیشتر محیطهای task طولانیمدت، تنوع بیشتر تو نوع این محیطها، و مدت زمان طولانیتر post-training به دست اومده. طبق ادعای خود شرکت، تو ارزیابیهای داخلیشون، توانایی کدنویسی مدل ۵۰ درصد نسبت به GLM-5.2 بهبود پیدا کرده و تو بنچمارکهای عمومی مثل Terminal-Bench 3.0 و Agents' Last Exam، رتبهی اول رو بین مدلهای متنباز گرفته؛ با توانایی کدنویسی و agent نزدیک به Claude Fable 5.
بعد رفتن سراغ امنیت سایبری
یکی از جاهایی که مدلهای چینی مثل Kimi یا Qwen تا الان از مدلهای frontier آمریکایی عقب بودن، امنیت سایبریه. Zhipu مستقیم رفته سراغ همین نقطهضعف: GLM-5.3 رو با داده و محیطهایی آموزش داده که مخصوص پیدا کردن آسیبپذیری نرمافزار طراحی شده. طبق توضیح Z.ai، این مدل شروع کرده به استدلال کردن رو چند مرحلهی مختلف بهرهبرداری و ساختن برنامههای منسجم برای زنجیرهی کامل اکسپلویت.
با همکاری تیمهای امنیتی تو چین، شرکت میگه این مدل ۲۴۳۶ آسیبپذیری رو تو ۲۶۹ پروژه پیدا کرده؛ بعضی از این آسیبپذیریها تا ۴۰-۴۵ سال قدمت داشتن. تو بنچمارک CyberGym هم امتیاز ۸۴.۵ درصد گرفته که کمی از Claude Mythos 5 و GPT-5.6 Sol بهتره، هرچند تو تسکهای عمیقتر بهرهبرداری مثل ExploitBench، هنوز فاصلهای با مدلهای frontier بسته باقی مونده.
وزنها هنوز باز نشدن
با اینکه Zhipu این مدل رو بهعنوان open-weights معرفی میکنه، خود فایلهای وزن هنوز قابل دانلود نیستن. طبق اعلام شرکت، این وزنها حدود دو هفته بعد از انتشار، بعد از یه دور بررسی امنیتی، منتشر میشن. تا اون موقع، تنها راه دسترسی به مدل از طریق GLM Coding Plan خود Zhipu و integration هایی مثل ZCode، Claude Code، و OpenCode است.
همین تأخیر تو انتشار وزنها یعنی فعلاً هیچ بنچمارک یا تست مستقلی از سمت جامعهی خارج از Zhipu وجود نداره؛ تمام اعداد و ادعاهای بالا (بهبود ۵۰ درصدی، رتبهی اول بین مدلهای متنباز) صرفاً بر اساس ارزیابیهای داخلی خود شرکته و باید تا انتشار واقعی وزنها، با احتیاط بهشون نگاه کرد.
دسترسی برای کاربران فعلی
همزمان با انتشار، Zhipu اعلام کرد که quota مصرف همهی کاربران GLM Coding Plan، ساعت ۱۳:۰۰ همون روز ریست شده و کاربرها میتونن سهمیهی جدیدشون رو تو بخش «Usage Statistics» ببینن.
جمعبندی
اگه قبلاً از GLM-5.2 برای کارهای کدنویسی استفاده میکردی، GLM-5.3 همین الان از طریق GLM Coding Plan در دسترسه و طبق ادعای شرکت، جهش محسوسی تو agent-based task ها داره. ولی اگه دنبال self-host کردن یا استفادهی offline از این مدل هستی، باید حدود دو هفته صبر کنی تا وزنها منتشر بشن؛ و بعد از انتشارشون هم ارزش داره منتظر بنچمارکهای مستقل بمونی تا ببینی ادعاهای Zhipu چقدر تو عمل هم صدق میکنه.
