Моделі та платформи ШІ
OpenAI знижує ціни на API для двох своїх дешевших моделей GPT-5.6

OpenAI знизила ціни на API для двох своїх нижчих моделей GPT-5.6 30 липня 2026 року, знижуючи ціну на найдешевший рівень на 80% і на середній рівень на 20%, залишаючи свою флагманську модель без змін. Ця зміна зареєстрована в журналі змін компанії та вже доступна на опублікованій ціновій картці.
За мільйон входів і виходів токенів стандартні тарифи тепер виглядають так:
- GPT-5.6 Luna: 20 центів і $1,20, замість $1 і $6
- GPT-5.6 Terra: $2 і $12, замість $2,50 і $15
- GPT-5.6 Sol: $5 і $30, без змін, що відповідає тарифу її попередниці GPT-5.5
Всі три рівні досягли загальної доступності 9 липня 2026 року за вищими цінами, що означає, що зміна цін відбулася через три тижні після початку комерційного життя сім’ї.
Зниження цін відбувається у всіх сервісних рівнях, а не тільки в заголовній ставці. Батч- і Флекс-процеси, які становлять половину стандартної ціни, тепер встановлюють рівень Луни на рівні 10 центів за входи і 60 центів за виходи. Кешовані читання входів, з знижкою 90%, знижуються до двох центів за мільйон токенів на рівні Луни і 20 центів на рівні Терри. Довгі контекстні запити, які рахуються за подвійну ставку входів і 1,5-кратну ставку виходів, становлять 40 центів і $1,80 для Луни. Покупці, які проходять через Amazon Bedrock, рахуються за тарифами AWS, і OpenAI зазначає, що ці тарифи можуть відрізнятися від власних.
Дешевші рівні – це те місце, де живе високовольтний виробничий трафік: класифікація, витягання, маршрутизація запитів, перший прохід чернетки та довгі агентські петлі, де одна команда користувача може викликати десятки модельних викликів, перш ніж повернути відповідь. П’ятикратне зниження рівня, який поглинає цей об’єм, змінює арифметику щодо того, які робочі навантаження варто автоматизувати взагалі.
Де дешевші рівні знаходяться проти Клода
За 20 центів за входи і $1,20 за виходи Луна підніжиться нижче найдешевшої опублікованої моделі Антропіка, Хайку 4.5, у п’ять разів за входами і приблизно в чотири рази за виходами, згідно з ціновою сторінкою Антропіка. Новий тариф Терри знаходиться нижче $3 і $15, які Клоду Сонет 5 будуть коштувати після закінчення вступної ціни $2 і $10 31 серпня 2026 року. На верхівці обох лінійок Сол все ще коштує дорожче за виходи, ніж Опус 5, який Антропік цінує в $5 і $25.
Пріоритетна обробка стає швидким режимом
Той самий журнал змін виводить з експлуатації Пріоритетну обробку і заміняє її на Швидкий режим. Для Сол OpenAI заявляє, що Швидкий режим працює до 2,5 разів швидше за стандартну швидкість за подвійну ціну, і перемикач є зворотньо сумісним: запити, вже позначені для пріоритету, маршрутизуються до Швидкого режиму без зміни коду. Тарифи Швидкого режиму становлять $10 і $60 для Сол, $4 і $24 для Терри, і 40 центів і $2,40 для Луни.
Антропік продає той самий продукт під тією ж назвою і на тих самих умовах – швидкий режим для Опус 5, до 2,5 разів швидше за подвійну стандартну ціну. Дві тарифні картки тепер збігаються на регіональній закріпленій інференції. OpenAI стягує 10% підвищення на моделі, випущені 5 березня 2026 року або пізніше, коли клієнт вимагає резиденцію даних; Антропік рахує інференцію тільки для США за 1,1-кратну стандартну ставку.
Що зробило дешевші рівні дешевшими
OpenAI опублікувала свій обліковий звіт за день до зниження цін. У статті від 29 липня 2026 року п’ять членів її технічного штату описали оптимізації інференції та агентської упряжі за моделлю GPT-5.6. Сол, що працює всередині Кодекса, переписала виробничі ядра GPU компанії; у поєднанні з більш широкою роботою з ядрами OpenAI заявляє, що це знизило кінцеву вартість обслуговування на 20%. Сол також переробила свою власну спекулятивно-декодуючу модель чернетки через сотні експериментів, які компанія вважає підвищенням ефективності генерації токенів на понад 15%.
Це власні дані OpenAI щодо її власної стека. Стаття закінчилася на зобов’язанні передавати “під капотом поліпшення нашим користувачам і клієнтам у вигляді більш широко доступної, економічно ефективної інтелектуальної системи.” Ціновий лист слідував за цим через день.
Робота з упряжкою вказує на той самий центр витрат, на який вказує зниження цін. OpenAI обмежує вивід інструменту до 10 000 токенів за замовчуванням і зберігає модельно-видиму історію тільки для додання, тому агентська петля, яка повторно відсилає свої інструкції та визначення інструменту на кожному кроці, потрапляє в кеш входів замість сплати повної входної ставки. Для завдання, яке вимагає 30 модельних запитів, це 30 шансів уникнути повторного розрахунку того самого префіксу.
Зниження цін відбувається під час аудиту витрат на інференцію та розширення тих команд, які торкаються моделей: власні дослідження OpenAI виявили, що співробітники використовують ChatGPT далеко за межами своїх посад. Інженерна організація Amazon вирішила обмежити витрати на AI після перевитрат того самого дня, і OpenAI ввела жорсткі ліміти витрат для організацій і проєктів API 22 липня 2026 року, дозволяючи адміністраторам встановлювати місячний ліміт, який починає повертати помилки, коли відстежувані витрати досягають його.
Для команди, яка вже маршрутизує великовольтний трафік до Луни, ті самі виклики тепер коштують у п’ять разів менше, ніж раніше, з тим лімітом, який можна встановити в панелі керування. З ціною Сол без змін, рішення залишається там, де OpenAI його встановила з моменту випуску сім’ї: який рівень кожному запиту потрібно.












