GPT-۵.۶ ارزانتر شد؛ Fast Mode برای کدام بار کاری است؟
اعلامیه ۳۰ ژوئیه ۲۰۲۶ OpenAI دو تغییر جداگانه را کنار هم گذاشت: قیمت Terra و Luna پایین آمد و Fast Mode در API جای Priority Processing را گرفت. این خبر درباره عرضه مدل تازه نیست؛ درباره اقتصادیتر شدن استفاده مستمر از خانواده GPT-۵.۶ و ایجاد مسیر سریعتر برای

GPT-۵.۶ ارزانتر شد؛ Fast Mode برای کدام بار کاری است؟
اعلامیه ۳۰ ژوئیه ۲۰۲۶ OpenAI دو تغییر جداگانه را کنار هم گذاشت: قیمت Terra و Luna پایین آمد و Fast Mode در API جای Priority Processing را گرفت. این خبر درباره عرضه مدل تازه نیست؛ درباره اقتصادیتر شدن استفاده مستمر از خانواده GPT-۵.۶ و ایجاد مسیر سریعتر برای درخواستهایی است که تأخیر در آنها اهمیت دارد.
#اعداد جدید چه میگویند؟
طبق نرخ اعلامشده، Terra از این تاریخ ۲ دلار برای یک میلیون توکن ورودی و ۱۲ دلار برای خروجی قیمتگذاری شد. Luna به ۰٫۲۰ دلار برای ورودی و ۱٫۲۰ دلار برای خروجی رسید. OpenAI گفت این قیمتهای جدید در Codex و ChatGPT Work نیز در تعداد اعتبار مصرفی اثر میگذارند، اما قیمت اشتراکها و بودجه quota همانند قبل باقی میماند. همچنین rollout قیمتها در AWS قرار بود همان روز آغاز شود؛ این جزئیات برای سازمانهایی که از چند مسیر ارائه استفاده میکنند مهم است.
کاهش قیمت بهتنهایی به معنی ارزان شدن کل سامانه نیست. در کارهای عاملمحور، تعداد فراخوانی ابزار، حجم زمینه، retry و زمان نگهداری trace میتواند از نرخ خام مدل مهمتر شود. یک pipeline که با Luna در نگاه اول کمهزینه است، اگر خروجی ناقص تولید کند و چند بار بازاجرا شود، ممکن است از Terra گرانتر تمام شود.
#Fast Mode چه چیزی را عوض میکند؟
Fast Mode برای مشتری API راهی است تا در سمت Sol زمان پاسخ را در اولویت قرار دهد. این گزینه جای Priority Processing را میگیرد و با حالت fast در Codex همراستا میشود. درخواستهایی که پیشتر با برچسب priority ارسال شدهاند، طبق اعلامیه همچنان کار خواهند کرد؛ بنابراین تغییر یکباره قرارداد برنامهها لازم نیست.
این قابلیت برای همه درخواستها منطقی نیست. پردازش شبانه اسناد، embeddingهای دستهای یا ارزیابیهای بزرگ معمولاً بیشتر از سرعت، به هزینه قابل پیشبینی نیاز دارند. در مقابل، دستیار داخل محصول، بررسی تعاملی کد یا مرحلهای از workflow که کاربر منتظر آن است، میتواند از مسیر سریعتر سود ببرد.
#تصمیم عملی برای تیمها
بهتر است سه کلاس workload تعریف شود: کار حجمی با Luna، کار متعادل با Terra، و مسیرهای حساس یا پیچیده با Sol. برای کلاس سوم، Fast Mode باید با SLO مشخص فعال شود، نه بهعنوان تنظیم پیشفرض. داشبورد هزینه باید ورودی، خروجی، cache، تعداد ابزار و زمان پاسخ را کنار هم نشان دهد.
OpenAI در همین اطلاعیه تأکید میکند که Terra و Luna ابزار و workflow چندمرحلهای را هم پشتیبانی میکنند. این نکته دامنه کاربرد مدلهای ارزانتر را بزرگ میکند، اما جای آزمون را نمیگیرد. سازمانی که نرخ جدید را بدون اندازهگیری کیفیت و بازکاری اعمال کند، فقط صورتحساب را جابهجا کرده است؛ معماری هزینه هنوز حل نشده است.
مطالب مرتبط
برای ادامه مطالعه
این یادداشتها بر اساس موضوع مشترک، همپوشانی برچسبها و تازگی انتشار انتخاب میشوند.

GPT Transcribe؛ دو مسیر برای رونویسی فایل و گفتوگوی زنده
یادداشت انتشار OpenAI در ۲۸ ژوئیه ۲۰۲۶ دو مدل صوتی را به API اضافه کرد: GPT Transcribe برای فایل و transcript نهایی، و GPT Live Transcribe برای رونویسی جریانی با تأخیر پایین. تفاوت آنها در یک نامگذاری ساده خلاصه نمیشود. یکی برای پردازش یک ورودی کامل و قابل

سیستمکارت GPT‑۵.۶؛ رشد توان عاملی و آزمونهای سختتر ایمنی
سیستمکارت GPT‑۵.۶ که OpenAI در ۹ ژوئیه ۲۰۲۶ منتشر کرد، بهجای تمرکز صرف بر امتیاز benchmark، مسیر ریسک مدل را تا محیط اجرا دنبال میکند. GPT‑۵.۶ خانوادهای از Sol، Terra و Luna است و در ارزیابیهای OpenAI در امنیت سایبری و زیستشناسی در سطح High capability قر

GPT-۵.۶؛ خانوادهای برای کار طولانی، نه فقط پاسخ سریع
OpenAI در ۹ ژوئیه ۲۰۲۶ GPT-۵.۶ را بهعنوان یک خانواده عرضه کرد، نه یک مدل منفرد با نام تازه. سه سطح Sol، Terra و Luna قرار است انتخاب مدل را به شکل عملیتری به نوع کار و بودجه وصل کنند. Sol پرچمدار است، Terra برای کار روزمره و Luna برای هزینه و سرعت پایینتر