OpenAI бағаларды төмендетіп, GPT-5.6 жылдамдығын арттырды
OpenAI GPT-5.6 модельдерінің бағасын төмендетіп, API үшін сұраныстарды өңдеуді жеделдететін жаңа Fast режимін ұсынды. Luna және Terra тарифтері айтарлықтай арзандады, ал өнімділік бәсекелестермен салыстырғанда артты.
Crius
OpenAI өздерінің GPT-5.6 модельдер желісінің бағасын төмендеткенін және API үшін жаңа Fast режимін енгізгенін хабарлады. Бұл өзгерістер компанияның қолжетімді нұсқаларына жататын Luna және Terra тарифтеріне әсер етеді. Сондай-ақ, Luna өнімділігі мен құны бойынша Google, Anthropic және басқа компаниялардың ұқсас шешімдерімен салыстырмалы деректер ұсынылды.
GPT-5.6 бағасының төмендеуі
GPT-5.6 модельдерінің барлық нұсқалары үшін API құны жұмыс тиімділігінің артуына байланысты төмендетілді, бұл жетістікке модельдердің өздері де ықпал етті. Жоғары жылдамдық пен қолжетімділігімен ерекшеленетін Luna тарифі 80% арзандады. Күнделікті тапсырмаларға арналған Terra тарифі 20% төмендеді. Жаңа бағалар 30 шілдеден бастап күшіне енді.
ChatGPT және Codex сервистеріне арналған жазылымдар мен лимиттер өзгеріссіз қалды, бірақ енді Terra және Luna модельдерін пайдалану осы жоспарлар аясында аз кредит жұмсайды.
API үшін жаңа Fast режимі
API-де бұрынғы Priority Processing деңгейінің орнына Fast режимі пайда болды. GPT-5.6 Sol моделі үшін Fast режимі сұраныстарды стандартты жылдамдықтан 2,5 есе тез өңдеуге мүмкіндік береді, бірақ құны екі есе жоғары болады және нәтиже сапасы өзгермейді. Барлық "priority" тегіндегі сұраныстар автоматты түрде жаңа режимге ауыстырылды.
Өнімділік пен құн салыстыруы
Өнімділігі бойынша Luna қазір бір жыл бұрын үздік деп саналған модельдермен теңесіп отыр, ал құны бір тапсырма үшін шамамен 6 центті құрайды және жылдамдығы тоғыз есе жоғары. Agents' Last Exam кәсіби бенчмаркіндегі нәтижелер бойынша Luna Claude Fable 5 моделінен жоғары нәтиже көрсетті, ал тапсырма құны 99% төмен болды.
Artificial Analysis v4.1 индексінде GPT-5.6 Luna 51 баллдан жоғары жинап, бір тапсырма үшін шамамен $0,05 тұрады. Бұл көрсеткіштер Claude Opus 5 Low және Gemini 3.6 Flash сияқты бәсекелестермен салыстырғанда тең немесе жоғары, ал олардың бағасы 5–10 есе қымбат.
Тиімділіктің арту себептері
Бұл нәтижелер үш бағыттағы жұмыстардың арқасында мүмкін болды: модель архитектурасы, инференс жүйелері және модельдерді құралдармен біріктіретін агенттік байланыс. GPT-5.6 Sol моделі жетілдірулерді іздеуге қатысып, өндірістік ядроларды автономды түрде қайта жазып, токен генерациясының тиімділігін арттыру үшін көптеген эксперименттер жүргізді. Ядроны оңтайландыру модельді қызмет көрсету шығындарын 20% төмендетті, ал эксперименттер токен генерациясының тиімділігін 15%-дан астам арттырды.
