گوگل بهجای Pro، سه مدل دیگه داد؛ (3.5 - 3.6) و این شاید داستان جالبتری باشه
چند وقتیه منتظر Gemini 3.5 Pro هستیم. گوگل توی رویداد I/O امسال قول داده بود این مدل رو «ماه بعد» عرضه کنه، ولی آن ماه گذشت، ماه بعدی هم گذشت، و بهجاش این هفته سه مدل دیگه اومد که هیچکدومشون Pro نبودن: Gemini 3.6 Flash، Gemini 3.5 Flash-Lite، و یک مدل عجیب به اسم Gemini 3.5 Flash Cyber. به نظرم خود همین انتخاب —اینکه گوگل ترجیح داده مدلهای سبکتر رو زودتر بفرسته و flagship رو بذاره بپزه— داستانی به همون اندازهی خود مدلها جالبه.
چرا Pro دیر شده
طبق گزارشهایی که این چند هفته منتشر شده، Gemini 3.5 Pro توی تستهای داخلی گوگل روی بنچمارکهای کدنویسی اونطور که باید عمل نکرده و تیم مهندسی مجبور شده دوباره برگرده سراغ retraining. گوگل رسماً تأیید کرده که مدل الان دست چند پارتنر و چند نهاد دولتیه برای تست، ولی تاریخ دقیقی برای عرضهی عمومی نداده. این یعنی حداقل فعلاً، اگه دنبال جایگزین GPT یا Claude توی ردهی سنگینوزن گوگل بودی، باید صبر کنی.
Gemini 3.6 Flash: جایگزین workhorse قبلی
این مدل قراره جانشین 3.5 Flash بشه، و نکتهای که واقعاً به چشم میاد کارایی تُکنه. گوگل میگه روی Artificial Analysis Index، این مدل تقریباً ۱۷ درصد کمتر از 3.5 Flash توکن خروجی مصرف میکنه، و برای کارهای چندمرحلهای هم تعداد reasoning step و tool call کمتری لازم داره. این برای کسی که داره agent میسازه خیلی مهمه، چون هزینهی واقعی یک agent معمولاً از تعداد round-trip ها میاد، نه فقط از قیمت هر توکن.
قیمتگذاری هم جالبه: ورودی همون $1.50 روی هر میلیون توکن مونده، ولی خروجی از $9 به $7.50 اومده پایین. یعنی گوگل مدل جدید و بهظاهر قویتر رو ارزونتر از قبلی عرضه کرده، که کار غیرمعمولیه — معمولاً نسخهی جدید گرونتر میشه.
از نظر کدنویسی هم گوگل ادعا میکنه 3.6 Flash خطاهای کمتری توی edit کد تولید میکنه و execution loop کمتری داره، یعنی کمتر پیش میاد مدل بین چند راهحل اشتباه گیر کنه و دور بزنه. روی DeepSWE عدد ۴۹ درصد رو اعلام کرده که نسبت به نسخهی قبلی جهش قابل توجهیه.
Gemini 3.5 Flash-Lite: برای حجم بالا
اگه پروژهات نیاز به throughput بالا داره — مثلاً ترجمهی حجم زیادی متن، یا پردازش batch اسناد — این مدل برای همین ساخته شده. قیمتش $0.30 روی ورودی و $2.50 روی خروجیه، یعنی از نسخهی قبلی (3.1 Flash-Lite) کمی گرونتر شده، ولی گوگل میگه کیفیتش قابل مقایسه نیست. روی Terminal-Bench 2.1 عدد ۵۴ درصد در مقابل ۳۱ درصد نسخهی قبلی گزارش شده که فاصلهی زیادیه. روی long-context هم (GDM-MRCR v2) از ۶۰ درصد به ۷۲ درصد رسیده.
نکتهای که به نظرم برای کار خودمون توی این بلاگ مهمه: اگه داری pipeline ترجمه یا پردازش متن فارسی میسازی و هزینه برات مهمه، این مدل دقیقاً همونجاییه که باید نگاهش کنی. برای کارهایی که Pro واقعی لازم نیست ولی حجم بالاست، معمولاً Flash-Lite گزینهی منطقیتریه تا اینکه بخوای برای هر درخواست پول یک مدل سنگین رو بدی.
Gemini 3.5 Flash Cyber: تخصصی و محدود
این یکی جالبترین معرفیه، چون هدفش عمومی نیست. مدلی fine-tune شده روی پایهی Flash، مخصوص پیدا کردن و patch کردن آسیبپذیریهای امنیتی کد. فعلاً فقط در اختیار دولتها و پارتنرهای منتخب گوگل قرار میگیره، نه توسعهدهندهی عادی. این حرکت رو خیلیها به رقابت گوگل با آنتروپیک در حوزهی امنیت کد مرتبط میدونن، جایی که آنتروپیک با مدلهای سری Mythos یک قدم جلوتر بوده.
چیزی که بین خطها نوشته شده
گوگل همزمان با این عرضه گفته که pretraining نسل بعدی، یعنی Gemini 4، رو شروع کرده. یعنی درحالی که همه منتظر Pro هستن، تیم گوگل عملاً یک نسل جلوتر داره کار میکنه. این الگو رو قبلاً هم دیده بودیم — وقتی یک مدل میانی دیر میشه، شرکتها بهجای نگه داشتن کاربر توی خلأ، یک لایهی سبکتر و ارزونتر رو زودتر میفرستن تا هم بازار رو نگه دارن هم فشار رقابتی رو کم کنن.
برای من بهعنوان کسی که مدام بین مدلهای مختلف API سوییچ میکنه، نکتهی عملی این خبر اینه: اگه الان روی 3.5 Flash کار میکنی، مهاجرت به 3.6 Flash احتمالاً بدون درد سره — قیمت پایینتره و بنچمارکها بهتره. ولی اگه منتظر Pro بودی که یک جهش واقعی توی reasoning بدی، هنوز باید صبر کنی، و با توجه به سابقهی این تأخیرها بعید نیست چند هفتهی دیگه هم طول بکشه.
