Модели и платформы ИИ
OpenAI снижает цены на API для двух более дешевых моделей GPT-5.6

OpenAI снизила цены на API для двух более дешевых моделей GPT-5.6 30 июля 2026 года, снизив цену на самый дешевый тарифный план на 80%, а на средний тарифный план – на 20%, при этом оставив свою флагманскую модель без изменений. Изменение отражено в журнале изменений API компании и уже доступно на опубликованной карте тарифов.
За миллион входных и выходных токенов стандартные тарифы теперь составляют:
- GPT-5.6 Luna: 20 центов и $1,20, что на 80% ниже предыдущей цены в $1 и $6
- GPT-5.6 Terra: $2 и $12, что на 20% ниже предыдущей цены в $2,50 и $15
- GPT-5.6 Sol: $5 и $30, без изменений, что соответствует тарифу его предшественника GPT-5.5
Все три тарифных плана стали доступны 9 июля 2026 года по более высоким ценам, что означает, что снижение цен произошло через три недели после начала коммерческой эксплуатации семейства моделей.
Снижение цен распространяется на все тарифные планы, а не только на основной тариф. Batch- и Flex-процессинг, которые составляют половину стандартной цены, теперь составляют 10 центов за входные данные и 60 центов за выходные данные для Luna. Скидка на входные данные в кэше, которая составляет 90%, снижается до 2 центов за миллион токенов для Luna и 20 центов для Terra. Долгие запросы, которые оплачиваются по двойной ставке за входные данные и в 1,5 раза за выходные данные, составляют 40 центов и $1,80 для Luna. Покупатели, которые проходят через Amazon Bedrock, оплачивают по тарифам AWS, и OpenAI отмечает, что эти тарифы могут отличаться от своих собственных.
Более дешевые тарифные планы используются для высокообъемного производственного трафика: классификации, извлечения, маршрутизации запросов, первоначального черновика и длинных циклов агентов, где одна инструкция пользователя может вызвать десятки вызовов модели, прежде чем будет дан ответ. Пятикратное снижение цены на тарифный план, который поглощает этот объем, меняет арифметику, которая определяет, какие рабочие процессы стоит автоматизировать.
Где стоят более дешевые тарифные планы по сравнению с Claude
При цене 20 центов за входные данные и $1,20 за выходные данные Luna обгоняет самый дешевый опубликованный модель Haiku 4.5 от Anthropic в 5 раз по входным данным и примерно в 4 раза по выходным данным, согласно странице тарифов Anthropic. Новая цена Terra находится ниже $3 и $15, которые тарифный план Claude Sonnet 5 будет стоить после окончания вводного тарифа в $2 и $10 31 августа 2026 года. На вершине обоих линеек Sol по-прежнему стоит дороже на выходных данных, чем Opus 5, который Anthropic оценивает в $5 и $25.
Приоритетная обработка становится режимом Fast
Тот же журнал изменений выводит из эксплуатации Приоритетную обработку и заменяет ее на Режим Fast. Для Sol OpenAI говорит, что Режим Fast работает со скоростью до 2,5 раза выше стандартной со скоростью, в два раза выше стандартной цены, и что переход является обратно совместимым: запросы, уже помеченные как приоритетные, маршрутизируются в Режим Fast без изменения кода. Тарифы на Режим Fast составляют $10 и $60 для Sol, $4 и $24 для Terra и 40 центов и $2,40 для Luna.
Anthropic продает тот же продукт под тем же названием и на тех же условиях – Режим Fast для Opus 5, до 2,5 раза быстрее со стандартной ценой, увеличенной в два раза. Две карты тарифов теперь сходятся на регионально-привязанной инференции. OpenAI взимает наценку в 10% на модели, выпущенные 5 марта 2026 года или позже, когда клиент требует резидентность данных; Anthropic взимает тариф в 1,1 раза от стандартного тарифа для инференции только в США.
Что сделало более дешевые тарифные планы дешевле
OpenAI опубликовала свою бухгалтерию за день до снижения цен. В посте от 29 июля 2026 года пять членов ее технического персонала описали оптимизации в области инференции и агентской упряжки за Codex и ChatGPT Work. Sol, работающая внутри Codex, переписала производственные ядра GPU компании; в сочетании с более широкой работой по ядрам OpenAI говорит, что это снизило конечные затраты на обслуживание на 20%. Sol также переработала свою собственную спекулятивно-кодированную модель черновика через сотни экспериментов, что, по мнению компании, увеличило эффективность генерации токенов более чем на 15%.
Это собственные цифры OpenAI для своей собственной стека. Пост завершился на обязательстве передать “улучшения под капотом нашим пользователям и клиентам в виде более широко доступной, экономически эффективной интеллекта”. Карта тарифов последовала на следующий день.
Работа над упряжкой указывает на тот же центр затрат, на который указывает снижение цен. OpenAI ограничивает выходные данные инструментов до 10 000 токенов по умолчанию и сохраняет модельно-видимую историю только для добавления, поэтому цикл агента, повторно отправляющий свои инструкции и определения инструментов на каждом шаге, попадает в кэш входных данных вместо оплаты полной входной ставки. Для задачи, которая требует 30 вызовов модели, это 30 возможностей избежать повторного вычисления того же префикса.
Снижение цен происходит во время, когда покупатели проверяют затраты на инференцию и расширяют команды, которые взаимодействуют с моделями: собственное исследование OpenAI показало, что сотрудники используют ChatGPT далеко за пределами своих должностей. Инженерная организация Amazon перешла на ограничение трат на ИИ после перерасхода средств в тот же день, и OpenAI ввела жесткие ограничения на траты для организаций и проектов API 22 июля 2026 года, позволяя администраторам устанавливать месячный потолок, который начинает возвращать ошибки, как только отслеживаемые траты достигают его. Для команды, которая уже маршрутизировала объемную работу на Luna, те же вызовы теперь стоят одной пятой от того, что они стоили ранее, с потолком, который они могут установить в панели управления. С неизменной ценой Sol решение остается там, где OpenAI поставила его с момента выхода семейства: какой тарифный план требуется для каждого запроса.












