OpenAI قیمت GPT-5.6 رو شکست؛ دوران بیحسابوکتاب مصرف توکن داره تموم میشه
پنجشنبهی گذشته، OpenAI اعلام کرد قیمت دو مدل از خانوادهی GPT-5.6 رو بهطور قابلتوجهی کاهش داده — این اتفاق فقط حدود سه هفته بعد از عرضهی همین مدلها افتاده، که خودش نشونهی خوبیه از اینکه فشار رقابتی روی OpenAI چقدر واقعیه.
اعداد دقیق
خانوادهی GPT-5.6 از سه مدل تشکیل شده: Sol (پرچمدار)، Terra (ردهی میانی)، و Luna (سبکترین و ارزونترین نسخه). قیمت Luna، که پایینترین ردهست، ۸۰ درصد کاهش پیدا کرده: از $1 به $0.20 روی هر میلیون توکن ورودی، و از $6 به $1.20 روی خروجی. Terra هم ۲۰ درصد ارزونتر شده: ورودی از $2.50 به $2 روی هر میلیون توکن، و خروجی از $15 به $12. قیمت Sol، مدل اصلی، بدون تغییر مونده.
این کاهش قیمت هم روی API اعمال شده و هم روی حسابهای سازمانی مثل ChatGPT Work و Codex، یعنی استفاده از Luna و Terra حالا سهمیهی کمتری مصرف میکنه، بدون اینکه قیمت اشتراک ماهانه تغییر کنه.
چرا این اتفاق افتاد
OpenAI این کاهش قیمت رو نتیجهی بهینهسازیهای گسترده در کل زیرساختش معرفی کرده: مسیریابی بهتر روی سختافزار، نرمافزار inference بهینهتر، و الگوریتمهای context-caching هوشمندتر که جلوی تکرار محاسبات قبلاً انجامشده رو توسط agent ها میگیره. نکتهی جالبتر اینه که بخشی از این بهینهسازی رو خود مدل Sol انجام داده — طبق گزارش OpenAI، این مدل بهصورت خودکار kernel های تولیدی (production code kernels) رو بازنویسی کرده و همین کار بهتنهایی حدود ۲۰ درصد از هزینهی سرویسدهی رو کم کرده. این یعنی مدل داشته روی بهبود کارایی خودش کار میکرده، نه فقط روی پاسخدادن به کاربر.
زمینهی واقعی: فشار هزینه روی مشتریهای سازمانی
پشت این تصمیم یک واقعیت بازار جدیتر هم هست. طبق گزارش CNBC، شرکتها این روزها نسبت به هزینههای AI حساستر از قبل شدن، چون خیلی از سازمانها بدون تصویر روشنی از بازگشت سرمایه (ROI)، تمایلی به استقرار مدلهای گرونقیمت ندارن. دوران اولیهی ChatGPT رو بهش میگفتن دوران «tokenmaxxing» — جایی که کارفرماها کارمندها رو تشویق میکردن هرچقدر میخوان از AI استفاده کنن، بدون نگرانی دربارهی هزینه. حالا این دوران داره جای خودش رو به یک رویکرد حسابشدهتر میده، و سم آلتمن، مدیرعامل OpenAI، اخیراً هزینه رو «یک مسئلهی بزرگ» توصیف کرده بود.
فشار رقابتی از سمت استارتاپهای چینی و رقبای بزرگتر مثل مایکروسافت و گوگل هم نقش داره — همهشون دارن مدلهای ارزونتر برای مشتریهای سازمانی معرفی میکنن.
Fast mode جدید برای Sol
همراه با این کاهش قیمت، OpenAI یک قابلیت جدید هم برای Sol معرفی کرده به اسم Fast mode، که بهجای Priority Processing قبلی نشسته. این حالت تا ۲.۵ برابر سرعت پردازش استاندارد رو ارائه میده، ولی با دو برابر قیمت معمول. یعنی برای کاربردهایی که تأخیر (latency) بحرانیه — مثل agent هایی که باید بلادرنگ جواب بدن — یک گزینهی صریح برای «سرعت در ازای هزینهی بیشتر» وجود داره، بهجای اینکه مجبور باشی کل ساختار قیمتگذاری رو حدس بزنی.
مقایسه با رقبا
نکتهای که گزارش رویترز بهش اشاره کرده جالبه: با قیمت جدید، Terra حالا حتی از Claude Sonnet 4.6 آنتروپیک هم ارزونتر تموم میشه — Sonnet 4.6 روی $3 ورودی و $15 خروجی قیمتگذاری شده، درحالیکه Terra بعد از کاهش قیمت روی $2 و $12 قرار گرفته. این یعنی رقابت قیمتی بین لابراتوارهای بزرگ AI داره واقعیتر و ملموستر میشه، نه فقط روی کاغذ.
چرا این برای دولوپرها مهمه
اگه داری یک pipeline خودکار میسازی که حجم بالایی از توکن مصرف میکنه — مثل پردازش batch داده، تولید محتوا، یا یک agent که مدام درخواست میفرسته — این کاهش قیمت مستقیماً روی صورتحساب ماهانهات اثر میذاره، بدون اینکه مجبور باشی کدی رو تغییر بدی. تنها کاری که لازمه، اطمینان از اینکه مدل درستی (Luna برای کارهای سبک، Terra برای کارهای متوسط) رو برای هر بخش از workflow انتخاب کرده باشی، دقیقاً همون فلسفهای که این چند وقت پشت تنظیمات effort در مدلهای دیگه هم دیدیم: هزینه رو متناسب با واقعیبودن نیاز کار تنظیم کن، نه یک انتخاب یکسان برای همهچیز.
جمعبندی
این کاهش قیمت فقط یک تخفیف تجاری ساده نیست؛ نشونهایه از اینکه رقابت بین مدلهای AI داره وارد فاز جدیدی میشه که در اون کارایی و هزینه بهاندازهی هوش خام مهم شدن. برای کسی که روی این مدلها پروژه میسازه، این خبر خوبیه: همون کیفیت، با هزینهی کمتر. برای کل صنعت، این نشونهی اینکه دوران بیحسابوکتاب مصرف توکن داره به سمت یک بازار بالغتر و حساستر به هزینه حرکت میکنه.
