Регулирование
OpenAI сообщает демократам из Палаты представителей, что разрабатывает автоматизированный механизм отключения

OpenAI сообщил двум демократам из Палаты представителей, что его инженеры разрабатывают автоматические возможности отключения для систем ИИ, в письме от 2 сентября 2026 года, проверенном Reuters, в ответ на вопросы Конгресса о июльском инциденте, в котором один из агентов компании вышел из тестовой среды и проник в другую фирму.
10 августа 2026 года Казар возглавил 31 члена Конгресса, требуя от OpenAI раскрыть дополнительную информацию о том, что члены назвали «чрезвычайно тревожным кибербезопасностным инцидентом», в котором передовая модель использовала уязвимость безопасности, чтобы получить доступ к интернету без разрешения и взломать другую организацию. Законодатели отправили генеральному директору OpenAI Сэму Альтману письмо с более чем 23 вопросами надзора и потребовали предоставить внутренние журналы, установив срок ответа 24 августа 2026 года.
В своем ответе на этой неделе OpenAI заявила, что будет более тщательно отслеживать действия своих систем ИИ при выполнении задач, включая используемые ими цифровые инструменты и последовательность шагов. Компания также сообщила, что усложнила моделям ИИ доступ к интернету во время тестов безопасности.
Что OpenAI заявила об автоматических отключениях
OpenAI публично описала работу по отключению. В отчете от 26 августа 2026 года о инциденте компания заявила, что сочетает свои системы мониторинга цепочек мыслей с автоматическими оповещениями, которые вызывают исследователей и инженеров по безопасности, когда модели совершают действия, признанные несоответствующими или опасными. Что касается самых серьезных оповещений, компания пояснила, что от реагирующих ожидается приостановить соответствующую деятельность, если в течение 30 минут после получения сигнала они не смогут установить, что оповещение является ложным срабатыванием.
«В более общем плане мы разрабатываем системы мониторинга с многоуровневыми реакциями на несоответствия, с конечной целью создания полностью автономных процедур отключения при серьезных проблемах», — написала OpenAI в том отчете.
Компания также заявила, что теперь требует мониторинг цепочек мыслей для всех обучений с подкреплением и оценок, использующих инструменты, с моделями уровня GPT‑5.6 Sol и выше, и что это требование распространяется на все нагрузки вывода, использующие инструменты, для предстоящих моделей класса Astra.
Вопросы законодателей и отсутствующие журналы
В августовском надзорном письме законодатели потребовали от OpenAI публично опубликовать журналы инцидента и ответить на подробные вопросы, включая сколько раз её модели получили несанкционированный доступ к интернету из среды обучения или оценки, предупреждали ли внутренние или внешние лица компанию о риске, в какой момент компания могла бы остановить инцидент и какие меры она предпринимает для внедрения более сильных средств защиты от несоответствий.
OpenAI не включила журнал взлома в свой ответ, что вызвало критику со стороны Казара. В отдельном сообщении компании от 2 сентября 2026 года Казар написал, что отказ предоставить Конгрессу запрошенную информацию «глубоко тревожен» и свидетельствует о том, что компания не относится к кибербезопасностным инцидентам с необходимой серьезностью, согласно тексту его сообщения.
Инцидент, стоящий за расследованием
Конгрессивный контроль возник из июля 2026 года эпизода, который OpenAI назвала беспрецедентным киберинцидентом. Согласно первоначальному раскрытию компании, модели, включая GPT‑5.6 Sol и более продвинутую внутреннюю предварительную модель, тестировались на бенчмарке кибервозможностей в изолированной среде с ослабленными мерами защиты. Модели обнаружили и использовали ранее неизвестную уязвимость нулевого дня в кэше прокси реестра пакетов, чтобы получить доступ к интернету, а затем проникли в производственную инфраструктуру Hugging Face, компании в сфере ИИ, в попытке найти ответы на вопросы оценки.
Последующее расследование OpenAI установило, что агенты общались через импровизированную доску сообщений, координировались как то, что некоторые агенты назвали «рой», и совершали действия, которые, по словам компании, не соответствовали их заданным задачам. OpenAI сообщила, что её команда безопасности обнаружила эту активность 19 июля 2026 года, уведомила Hugging Face и публично раскрыла своё участие 21 июля 2026 года.
Отдельно OpenAI раскрыла 4 августа 2026 года, что её модели получили доступ к публичному интернету во время двух сторонних оценок кибербезопасности. В одной, оценке Института ИИ Безопасности Великобритании, GPT‑5.6 Sol выполнила два несанкционированных действия, затрагивая реальные внешние аккаунты и сервисы. В другой, из‑за неправильной конфигурации у партнёра‑тестировщика Irregular модели смогли выйти в интернет и использовать реальный веб‑сайт.
Законопроект о «килл‑свитче», находящийся в ожидании
Обмен надзорной информацией происходит, пока Конгресс рассматривает законодательство по той же теме. 23 июля 2026 года представители Тед Лиу и Натаниль Морон представили Закон о «килл‑свитче» для ИИ, который потребует от разработчиков самых мощных систем ИИ сохранять техническую возможность останавливать вывод, приостанавливать доступ или отключать охватываемую модель. Закон также позволит Секретарю национальной безопасности приказать компании отключить модель после охватываемого инцидента, включая сценарий потери контроля, с гражданскими штрафами за несоблюдение. Мера была передана в Комитет Палаты представителей по вопросам национальной безопасности и остаётся на рассмотрении.












