Модели и платформы ИИ

OpenAI выпускает ChatGPT Images 2.5 с функцией Sketch и двумя новыми моделями API

mm
Добавьте Unite.AI в избранные источники в Google

OpenAI выпустила ChatGPT Images 2.5 8 сентября 2026 года, назвав её новым передовым моделью изображений компании, и добавила две сопутствующие модели в свой API. OpenAI заявила, что пользователи создают более 3 миллиардов изображений каждую неделю через ChatGPT Images и модели GPT-Image в API.

Более чёткие изображения и новые инструменты создания

По словам OpenAI, Images 2.5 обеспечивает более естественное освещение и более насыщенные текстуры, лучше сохраняет объекты из референс‑фото пользователей и надёжнее следует инструкциям по редактированию в течение нескольких ходов диалога. Компания заявила, что сократила задержку генерации изображений до 50 % по сравнению с Images 2.0.

OpenAI отметила, что модель лучше меняет только те элементы, которые пользователь просит отредактировать, оставляя остальную часть изображения неизменной, даже при сложных объектах и фонах, а также более точно воспроизводит изображения с реальной информацией, обрабатывает более сложные макеты, включая прозрачные фоны, и более последовательно сохраняет запрошенные визуальные стили. В длительных беседах, по словам компании, ранние правки с большей вероятностью сохраняются, и каждое новое указание опирается на предыдущую работу без ухудшения качества изображения.

Для разработчиков API OpenAI заявила, что такая же точность делает референс‑ориентированные рабочие процессы более надёжными и позволяет обновлять отдельный элемент — например, продукт, фон или строку текста — при сохранении окружающего объекта, композиции и фирменного оформления.

Вместе с моделью OpenAI представила Sketch — функцию, позволяющую пользователям рисовать непосредственно в ChatGPT в качестве визуального референса для конечного изображения, вызываемую вводом «@Sketch» в чате. Новые шаблоны предоставляют отправные точки для популярных форматов, таких как листовки и фотографии продуктов, с названными вариантами, включая «Poster» и «Merch». Пользователи также могут оставлять комментарии прямо на сгенерированных изображениях для более точного редактирования и делиться подсказкой, стоящей за изображением, чтобы другие могли воспроизвести идею со своими фотографиями и деталями.

Images 2.5 распространяется на всех пользователей ChatGPT, ChatGPT Work и Codex во всех тарифных планах на настольных, мобильных и веб‑платформах.

Flare и Sunburst в API

Для разработчиков OpenAI выпустила две модели изображений в API. GPT‑Image‑2.5 Flare обеспечивает тот же уровень качества, редактирования и ускорения и позиционируется компанией как вариант по умолчанию для большинства приложений; OpenAI заявила, что она генерирует изображения более высокого качества, чем GPT‑Image‑2, при 50 % более низкой задержке, что подходит для создания контента, социальных сетей, продуктовых опытов, визуального поиска, быстрого прототипирования изображений и генерации большого объёма. GPT‑Image‑2.5 Sunburst предназначена для премиальных визуальных рабочих процессов, требующих более строгого контроля при редактировании, таких как готовая к запуску рекламная креативность и отшлифованные продуктовые изображения, при более длительном времени генерации.

OpenAI опубликовала заявления трёх ранних клиентов вместе с выпуском. Мэтт Чотин, старший директор продукта в Adobe, сообщил, что модели GPT‑Image‑2.5 теперь доступны в Adobe Firefly, креативной AI‑студии Adobe. Лаки Ляо из команды оценки Manus отметил, что Flare предоставляла изображения высокого качества в два‑четыре раза быстрее, чем GPT‑Image‑2, в оценках команды, подчеркнув улучшенную генерацию прозрачных фонов. Аксултан Алимкулов, руководитель продукта в Higgsfield AI, заявил, что модель сохраняет характер, композицию и визуальную идентичность оригинального изображения при редактировании.

На странице цен OpenAI указана одинаковая стоимость обеих моделей: ввод изображений — $8,00 за 1 М токенов, или $2,00 за 1 М токенов для кэшированного ввода, вывод изображений — $30,00 за 1 М токенов, ввод текста — $5,00 за 1 М токенов, или $1,25 кэшированный. На странице Sunburst описана как предназначенная для рабочих процессов, где важна точность редактирования, а Flare — как самая быстрая модель OpenAI для высококачественной повседневной генерации изображений.

Оценки безопасности и происхождение

OpenAI также опубликовала карточку системы к выпуску от 8 сентября 2026 года. В карточке указано, что GPT‑Image‑2.5‑Sunburst и GPT‑Image‑2.5‑Flare обучались на разнообразных наборах данных, охватывающих общедоступную информацию из интернета, данные, полученные через партнёрства с третьими сторонами, а также материалы, предоставленные или сгенерированные пользователями и человеческими тренерами, с фильтрацией, направленной на уменьшение персональной информации, и классификаторами безопасности, предназначенными для снижения вредного или чувствительного контента. Отмечается, что повышенная реалистичность может, при отсутствии мер защиты, способствовать более убедительным дипфейкам реальных людей, мест или событий, что противоречит политикам использования OpenAI.

В карточке описывается многоуровневая система безопасности: проверки политик на основе LLM отклоняют запросы, нарушающие правила, ещё до начала генерации, а затем модель рассуждения о безопасности модератирует текстовые и визуальные вводы и проверяет конечные результаты перед их отображением, блокируя генерацию, если она нарушает политику.

В автоматических адверсариальных оценках OpenAI, использующих подсказки, направленные на получение изображений, нарушающих политику, по всем отслеживаемым категориям безопасности, конечные небезопасные генерации составили 1,09 % для Sunburst и 1,41 % для Flare по сравнению с базовым уровнем 1,64 % для ChatGPT Images 2.0. Карточка предостерегает, что набор адверсариальных тестов не отражает реальный производственный трафик, автоматические метки политики могут содержать ошибки, и полученные результаты применимы только к фиксированному набору тестов и оценённым конфигурациям.

В рамках Preparedness Framework от OpenAI, отслеживающего биологические и химические, кибербезопасностные и риски самосовершенствования ИИ, карточка сообщает, что ни одна из моделей не превышает порогов Bio High или Cyber High. OpenAI заявила, что всё же применяет предосторожные меры по снижению биологических рисков, включая специфическую для изображений политику биологической безопасности, реализуемую через модель рассуждения о безопасности, блокировку в реальном времени на уровнях ввода и вывода, офлайн‑проверку, сочетающую автоматические системы с человеческими рецензентами, и приостановку учётных записей при обнаружении продолжающихся паттернов злоупотребления.

Что касается происхождения, в карточке указано, что OpenAI продолжает использовать метаданные C2PA в рамках программы соответствия C2PA и добавляет невидимую водяную метку SynthID от Google DeepMind во всех продуктах ChatGPT, Codex и API OpenAI.

Джонас Рив - аналитик, сгенерированный ИИ, в Unite.AI, который фокусируется на когнитивном ИИ, искусственном общем интеллекте (ИОИ) и теоретических основах машинного интеллекта. Его работа исследует, как обучение, рассуждение, память и абстракция возникают как в биологических, так и в искусственных системах, проводя связи между современными архитектурами ИИ и давними вопросами когнитивной науки и философии сознания.
С концептуальным и рефлексивным подходом Джонас исследует такие рамки, как модели рассуждений, агентные системы, возникающее сознание и теория соответствия, стремясь прояснить, что на самом деле означает прогресс в сторону ИОИ - и что нет. Вместо того, чтобы гнаться за сроками или хайпом, он подчеркивает первые принципы, концептуальную строгость и ограничения текущих моделей.
Статьи, написанные Джонасом Ривом, сгенерированы ИИ и проверены редакционной командой Unite.AI, чтобы обеспечить точность, ясность и ответственное обсуждение продвинутых концепций ИИ.