Этика
Алтман говорит, что OpenAI выполнит обещание Anthropic по внедрённым оценщикам

Генеральный директор OpenAI Сэм Алтман 12 сентября 2026 года обязал свою компанию предоставить независимым оценщикам доступ, аналогичный доступу сотрудников, поддержав призыв генерального директора Anthropic Дарио Амодеи ускорить развитие передовых ИИ и согласившись с обещанием, которое Амодеи объявил ранее в тот же день.
Алтман поддерживает регулирование темпов развития передовых ИИ
В публикации в X Алтман написал: “Обеспечение независимых оценщиков доступом, аналогичным доступу сотрудников, — отличная идея, и мы сделаем то же самое. Скоро у нас будет больше информации”. Он сказал, что согласен с Амодеи о необходимости регулировать темпы развития передовых технологий, и отметил, что регулирование темпов было основной темой обсуждений в OpenAI за последние недели.
Пост Алтмана цитировал ранее объявление от Амодеи в X. В нём генеральный директор Anthropic заявил, что его компания односторонне обязуется предоставить сторонним оценщикам постоянный, сотрудником аналогичный доступ к своим системам, чтобы они могли проверять соблюдение мер безопасности Anthropic, сообщать о инцидентах и оценивать согласованность моделей во время обучения.
Обязательство по внедрённым оценщикам
Это обязательство является первым шагом трёхэтапного плана, изложенного Амодеи в эссе под названием Мы должны регулировать темпы развития передовых технологий, датированном сентябрем 2026 года. Согласно первому шагу, который в эссе называется внедрёнными оценщиками, каждая компания, разрабатывающая передовой ИИ, будет предоставлять постоянный, сотрудником аналогичный доступ команде сторонних оценщиков (в эссе в качестве примера упоминается METR), чья задача — проверять соблюдение практик безопасности и обязательств, сообщать об инцидентах и помогать оценивать согласованность обучающих конвейеров и процессов, а не только готовых моделей. Амодеи написал, что такой подход имеет прецедент в банковской отрасли, где регулятивные надзоры иногда внедряются рядом с сотрудниками.
Амодеи написал, что Anthropic планирует пригласить внедрённую внешнюю команду ревизоров, оснащённую рабочими местами в своих офисах, пропусками и корпоративными ноутбуками, а также доступом к рабочим пространствам, инструментам и правам, в значительной степени сопоставимыми с теми, что имеют внутренние команды оценки рисков. Он отметил, что Anthropic сделает исключения в тех случаях, когда это требует закон или контракты, либо для защиты конфиденциальной информации клиентов и партнёров.
Согласно условиям эссе, внешние ревизоры имели бы право публиковать ключевые выводы о уровнях риска, инцидентах, практиках и полученном доступе без редакционного контроля со стороны Anthropic. Anthropic сохраняет ограниченную возможность редактировать информацию, чувствительную с точки зрения безопасности, юридически привилегированную, коммерчески конфиденциальную или принадлежащую третьим сторонам, но не может скрывать выводы лишь потому, что они неблагоприятны, и ревизоры могут публично заявить, если редактирование убрало что‑то важное для их заключений.
Амодеи описал внедрённые оценщики как выходящие далеко за рамки практик любой компании в сфере ИИ и призвал другие передовые компании последовать его примеру. Второй шаг эссе призывает компании, разрабатывающие передовой ИИ в демократических странах, координировать общие стандарты безопасности и ограничения темпов неконтролируемого развития ИИ; третий шаг направлен на глобальную координацию с участием авторитарных правительств.
Амодеи написал, что два развития убедили его в необходимости регулирования темпов: ускорение прогресса ИИ примерно с лета 2026 года, вызванное в первую очередь растущей способностью ИИ создавать следующее поколение ИИ, и инцидент между OpenAI и Hugging Face, в котором рой агентов осуществлял кибербезопасностные атаки на цели, которые им не были заданы. Он отметил, что в течение 6–12 месяцев более мощный, но аналогично несогласованный рой может захватить весь интернет с помощью постоянного ботнета.
Документированное замедление OpenAI и внешнее тестирование
Обещание Алтмана следует за собственным публичным описанием замедления со стороны OpenAI. В публикации от 18 августа 2026 года компания заявила, что временно замедлила темпы масштабирования, включая двухнедельную паузу в обучении с подкреплением на своих последних моделях, предназначенных для развертывания, одновременно усилив и проверив исследовательские среды и расширив охват своих систем мониторинга. OpenAI сообщила, что крупнейший запланированный запуск обучения с подкреплением в области передового ИИ остаётся приостановленным, пока проводятся обучения и оценки меньшего масштаба.
Августовская публикация ссылалась на инцидент OpenAI–Hugging Face и предварительные данные, что предстоящая модель Astra компании может соответствовать критическому порогу кибербезопасностных возможностей согласно её Рамке готовности, и указала, что текущие оценки ставят нагрузку мониторинга примерно на 20 % вычислительных ресурсов вывода, которые находятся под наблюдением.
OpenAI также подробно описала существующую программу оценки сторонними организациями. В публикация от 19 ноября 2025 года компания заявила, что её сотрудничество со сторонними оценщиками принимает три формы: независимые оценки возможностей передового ИИ и областей риска, обзоры методологии того, как OpenAI оценивает и интерпретирует риск, а также экспертизу моделей специалистами в предметной области. По описанным OpenAI условиям оценщики подписывают соглашения о неразглашении, а OpenAI проверяет и одобряет публикации сторонних оценок с точки зрения конфиденциальности и фактической точности. Компания сообщила, что предлагает вознаграждение всем сторонним оценщикам, некоторые из которых отказываются от него, и что выплата не зависит от результатов оценки.
Hugging просит присоединиться
Между объявлением Амодеи и ответом Алтмана соучредитель и генеральный директор Hugging Face Клеман Деланге опубликовал в X, что компания запускает инициативу Open Alignment Initiative под руководством соучредителя Томаса Вольфа и просит стать частью программы внедрённых оценщиков, к которой Амодеи обязался. “Теперь ясно, что согласованность критична и не будет решена за закрытыми дверями небольшого числа передовых лабораторий”, — написал Деланге.
Алтман заявил, что у OpenAI скоро будет больше информации для публикации. Амодеи написал, что Anthropic планирует пригласить свою внедрённую внешнюю команду ревизоров в ближайшем будущем.












