Codoloper

GLM-5.3 منتشر شد: مدل چینی که ادعای قوی‌ترین کدنویس متن‌باز دنیا رو داره

GLM-5.3 منتشر شد: مدل چینی که ادعای قوی‌ترین کدنویس متن‌باز دنیا رو داره | عکس

شرکت چینی Zhipu AI (که با اسم تجاری Z.ai هم شناخته می‌شه) چهاردهم آگوست مدل جدیدش، GLM-5.3، رو منتشر کرد. طبق ادعای خود شرکت، این مدل الان قوی‌ترین مدل کدنویسی open-weights دنیاست؛ ادعایی که هنوز به‌طور مستقل تأیید نشده، ولی جزئیات فنی پشتش قابل توجهه.

بدون تغییر مدل پایه، فقط با post-training

نکته‌ی جالب GLM-5.3 اینه که دقیقاً همون معماری و مدل پایه‌ی نسخه‌ی قبلی (GLM-5.2) رو داره؛ هیچ pretraining جدیدی انجام نشده. تمام بهبودها از یه دور گسترده‌ی post-training اومده؛ چیزی که Zhipu توضیح می‌ده با استفاده از ده‌ها برابر بیشتر محیط‌های task طولانی‌مدت، تنوع بیشتر تو نوع این محیط‌ها، و مدت زمان طولانی‌تر post-training به دست اومده. طبق ادعای خود شرکت، تو ارزیابی‌های داخلیشون، توانایی کدنویسی مدل ۵۰ درصد نسبت به GLM-5.2 بهبود پیدا کرده و تو بنچمارک‌های عمومی مثل Terminal-Bench 3.0 و Agents' Last Exam، رتبه‌ی اول رو بین مدل‌های متن‌باز گرفته؛ با توانایی کدنویسی و agent نزدیک به Claude Fable 5.

بعد رفتن سراغ امنیت سایبری

یکی از جاهایی که مدل‌های چینی مثل Kimi یا Qwen تا الان از مدل‌های frontier آمریکایی عقب بودن، امنیت سایبریه. Zhipu مستقیم رفته سراغ همین نقطه‌ضعف: GLM-5.3 رو با داده و محیط‌هایی آموزش داده که مخصوص پیدا کردن آسیب‌پذیری نرم‌افزار طراحی شده. طبق توضیح Z.ai، این مدل شروع کرده به استدلال کردن رو چند مرحله‌ی مختلف بهره‌برداری و ساختن برنامه‌های منسجم برای زنجیره‌ی کامل اکسپلویت.

با همکاری تیم‌های امنیتی تو چین، شرکت می‌گه این مدل ۲۴۳۶ آسیب‌پذیری رو تو ۲۶۹ پروژه پیدا کرده؛ بعضی از این آسیب‌پذیری‌ها تا ۴۰-۴۵ سال قدمت داشتن. تو بنچمارک CyberGym هم امتیاز ۸۴.۵ درصد گرفته که کمی از Claude Mythos 5 و GPT-5.6 Sol بهتره، هرچند تو تسک‌های عمیق‌تر بهره‌برداری مثل ExploitBench، هنوز فاصله‌ای با مدل‌های frontier بسته باقی مونده.

وزن‌ها هنوز باز نشدن

با این‌که Zhipu این مدل رو به‌عنوان open-weights معرفی می‌کنه، خود فایل‌های وزن هنوز قابل دانلود نیستن. طبق اعلام شرکت، این وزن‌ها حدود دو هفته بعد از انتشار، بعد از یه دور بررسی امنیتی، منتشر می‌شن. تا اون موقع، تنها راه دسترسی به مدل از طریق GLM Coding Plan خود Zhipu و integration هایی مثل ZCode، Claude Code، و OpenCode است.

همین تأخیر تو انتشار وزن‌ها یعنی فعلاً هیچ بنچمارک یا تست مستقلی از سمت جامعه‌ی خارج از Zhipu وجود نداره؛ تمام اعداد و ادعاهای بالا (بهبود ۵۰ درصدی، رتبه‌ی اول بین مدل‌های متن‌باز) صرفاً بر اساس ارزیابی‌های داخلی خود شرکته و باید تا انتشار واقعی وزن‌ها، با احتیاط بهشون نگاه کرد.

دسترسی برای کاربران فعلی

همزمان با انتشار، Zhipu اعلام کرد که quota مصرف همه‌ی کاربران GLM Coding Plan، ساعت ۱۳:۰۰ همون روز ریست شده و کاربرها می‌تونن سهمیه‌ی جدیدشون رو تو بخش «Usage Statistics» ببینن.

جمع‌بندی

اگه قبلاً از GLM-5.2 برای کارهای کدنویسی استفاده می‌کردی، GLM-5.3 همین الان از طریق GLM Coding Plan در دسترسه و طبق ادعای شرکت، جهش محسوسی تو agent-based task ها داره. ولی اگه دنبال self-host کردن یا استفاده‌ی offline از این مدل هستی، باید حدود دو هفته صبر کنی تا وزن‌ها منتشر بشن؛ و بعد از انتشارشون هم ارزش داره منتظر بنچمارک‌های مستقل بمونی تا ببینی ادعاهای Zhipu چقدر تو عمل هم صدق می‌کنه.

کامنت جدید

برای ثبت کامنت وارد شوید

برای اینکه بتوانید زیر این پست کامنت بگذارید، باید وارد حساب کاربری خود شوید.

برای ادامه، وارد حساب خود شوید

بعد از ورود، دوباره به همین پست برمی‌گردید و می‌توانید کامنتتان را ثبت کنید.

ورود به حساب
کامنت‌ها

نظرات کاربران

دیدگاه‌هایی که برای این نوشته ثبت شده‌اند.

هنوز کامنتی برای این پست ثبت نشده است.