پرش به محتوا
منو
داده‌نوشت
فناوری، زیرساخت و هوش مصنوعی
هوش مصنوعی

GPT-۵.۶ ارزان‌تر شد؛ Fast Mode برای کدام بار کاری است؟

اعلامیه ۳۰ ژوئیه ۲۰۲۶ OpenAI دو تغییر جداگانه را کنار هم گذاشت: قیمت Terra و Luna پایین آمد و Fast Mode در API جای Priority Processing را گرفت. این خبر درباره عرضه مدل تازه نیست؛ درباره اقتصادی‌تر شدن استفاده مستمر از خانواده GPT-۵.۶ و ایجاد مسیر سریع‌تر برای

انتشار: ۸ مرداد ۱۴۰۵به‌روزرسانی: ۲۶ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای GPT-۵.۶ ارزان‌تر شد؛ Fast Mode برای کدام بار کاری است؟
تصویر رسمی OpenAI؛ منبع تصویر: https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/

GPT-۵.۶ ارزان‌تر شد؛ Fast Mode برای کدام بار کاری است؟

اعلامیه ۳۰ ژوئیه ۲۰۲۶ OpenAI دو تغییر جداگانه را کنار هم گذاشت: قیمت Terra و Luna پایین آمد و Fast Mode در API جای Priority Processing را گرفت. این خبر درباره عرضه مدل تازه نیست؛ درباره اقتصادی‌تر شدن استفاده مستمر از خانواده GPT-۵.۶ و ایجاد مسیر سریع‌تر برای درخواست‌هایی است که تأخیر در آن‌ها اهمیت دارد.

#اعداد جدید چه می‌گویند؟

طبق نرخ اعلام‌شده، Terra از این تاریخ ۲ دلار برای یک میلیون توکن ورودی و ۱۲ دلار برای خروجی قیمت‌گذاری شد. Luna به ۰٫۲۰ دلار برای ورودی و ۱٫۲۰ دلار برای خروجی رسید. OpenAI گفت این قیمت‌های جدید در Codex و ChatGPT Work نیز در تعداد اعتبار مصرفی اثر می‌گذارند، اما قیمت اشتراک‌ها و بودجه quota همانند قبل باقی می‌ماند. همچنین rollout قیمت‌ها در AWS قرار بود همان روز آغاز شود؛ این جزئیات برای سازمان‌هایی که از چند مسیر ارائه استفاده می‌کنند مهم است.

کاهش قیمت به‌تنهایی به معنی ارزان شدن کل سامانه نیست. در کارهای عامل‌محور، تعداد فراخوانی ابزار، حجم زمینه، retry و زمان نگهداری trace می‌تواند از نرخ خام مدل مهم‌تر شود. یک pipeline که با Luna در نگاه اول کم‌هزینه است، اگر خروجی ناقص تولید کند و چند بار بازاجرا شود، ممکن است از Terra گران‌تر تمام شود.

#Fast Mode چه چیزی را عوض می‌کند؟

Fast Mode برای مشتری API راهی است تا در سمت Sol زمان پاسخ را در اولویت قرار دهد. این گزینه جای Priority Processing را می‌گیرد و با حالت fast در Codex هم‌راستا می‌شود. درخواست‌هایی که پیش‌تر با برچسب priority ارسال شده‌اند، طبق اعلامیه همچنان کار خواهند کرد؛ بنابراین تغییر یکباره قرارداد برنامه‌ها لازم نیست.

این قابلیت برای همه درخواست‌ها منطقی نیست. پردازش شبانه اسناد، embeddingهای دسته‌ای یا ارزیابی‌های بزرگ معمولاً بیشتر از سرعت، به هزینه قابل پیش‌بینی نیاز دارند. در مقابل، دستیار داخل محصول، بررسی تعاملی کد یا مرحله‌ای از workflow که کاربر منتظر آن است، می‌تواند از مسیر سریع‌تر سود ببرد.

#تصمیم عملی برای تیم‌ها

بهتر است سه کلاس workload تعریف شود: کار حجمی با Luna، کار متعادل با Terra، و مسیرهای حساس یا پیچیده با Sol. برای کلاس سوم، Fast Mode باید با SLO مشخص فعال شود، نه به‌عنوان تنظیم پیش‌فرض. داشبورد هزینه باید ورودی، خروجی، cache، تعداد ابزار و زمان پاسخ را کنار هم نشان دهد.

OpenAI در همین اطلاعیه تأکید می‌کند که Terra و Luna ابزار و workflow چندمرحله‌ای را هم پشتیبانی می‌کنند. این نکته دامنه کاربرد مدل‌های ارزان‌تر را بزرگ می‌کند، اما جای آزمون را نمی‌گیرد. سازمانی که نرخ جدید را بدون اندازه‌گیری کیفیت و بازکاری اعمال کند، فقط صورت‌حساب را جابه‌جا کرده است؛ معماری هزینه هنوز حل نشده است.

مطالب مرتبط

برای ادامه مطالعه

این یادداشت‌ها بر اساس موضوع مشترک، هم‌پوشانی برچسب‌ها و تازگی انتشار انتخاب می‌شوند.

کاور جایگزین داده‌نوشت برای GPT Transcribe؛ دو مسیر برای رونویسی فایل و گفت‌وگوی زنده
هوش مصنوعی

GPT Transcribe؛ دو مسیر برای رونویسی فایل و گفت‌وگوی زنده

یادداشت انتشار OpenAI در ۲۸ ژوئیه ۲۰۲۶ دو مدل صوتی را به API اضافه کرد: GPT Transcribe برای فایل و transcript نهایی، و GPT Live Transcribe برای رونویسی جریانی با تأخیر پایین. تفاوت آن‌ها در یک نام‌گذاری ساده خلاصه نمی‌شود. یکی برای پردازش یک ورودی کامل و قابل

۶ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای سیستم‌کارت GPT‑۵.۶؛ رشد توان عاملی و آزمون‌های سخت‌تر ایمنی
هوش مصنوعی

سیستم‌کارت GPT‑۵.۶؛ رشد توان عاملی و آزمون‌های سخت‌تر ایمنی

سیستم‌کارت GPT‑۵.۶ که OpenAI در ۹ ژوئیه ۲۰۲۶ منتشر کرد، به‌جای تمرکز صرف بر امتیاز benchmark، مسیر ریسک مدل را تا محیط اجرا دنبال می‌کند. GPT‑۵.۶ خانواده‌ای از Sol، Terra و Luna است و در ارزیابی‌های OpenAI در امنیت سایبری و زیست‌شناسی در سطح High capability قر

۱۸ تیر ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای GPT-۵.۶؛ خانواده‌ای برای کار طولانی، نه فقط پاسخ سریع
هوش مصنوعی

GPT-۵.۶؛ خانواده‌ای برای کار طولانی، نه فقط پاسخ سریع

OpenAI در ۹ ژوئیه ۲۰۲۶ GPT-۵.۶ را به‌عنوان یک خانواده عرضه کرد، نه یک مدل منفرد با نام تازه. سه سطح Sol، Terra و Luna قرار است انتخاب مدل را به شکل عملی‌تری به نوع کار و بودجه وصل کنند. Sol پرچم‌دار است، Terra برای کار روزمره و Luna برای هزینه و سرعت پایین‌تر

۱۸ تیر ۱۴۰۵3 دقیقه