Взгляд Anderson

Где вы были, когда умерла реальность?

mm
Добавьте Unite.AI в избранные источники в Google
A picture of a cat peeping out of a box. No alterations, just cropping. Original image 'silver tabby cat in brown cardboard box' submitted to UnSplash in ноябрь 2020 by Elena Kloppenburg, used under permissive license – source https://unsplash.com/photos/silver-tabby-cat-in-brown-cardboard-box-f4HJPGXUiQY

Вчера вечером, как это часто бывает, моя жена пришла, чтобы показать мне различные видео и изображения, которые развеселили её в соцсетях после работы. Её подборки заметно склоняются к «милому» контенту, наполненному очаровательными животными и плюшевыми персонажами.

Вскоре она показала мне то, что сохранила, но ещё не успела посмотреть — видео «милые животные», в котором взаимодействуют самка коалы, её два спящих новорождённые детёныша и любопытный кот.

Сразу же я задумался, как молодой домашний кот может попасть в то же пространство, что и эти дикие животные, даже если предположить зоопарковую обстановку. Но я отмахнулся от этой мысли, как от назойливого комара, ведь это вполне укладывается в «жизнь странна».

Видео показывало статичный и довольно тесный кадр, где мать‑коала и её два спящих детёныша лежали на ткани, а мать опиралась о безликую стену.

Молодой осторожный полосатый кот вошёл в кадр, преодолев свою настороженность из‑за любопытства, и подкрался к спящим детёнышам, всё время наблюдая за матерью, которая могла бы неодобрительно взглянуть на это вмешательство.

После примерно минуты этого гипотетического тупика мать‑коала протянула лапу и подхватила молодого кота, удерживая его несколько мгновений, что полностью соответствует относительным весам и физиономиям обоих животных; затем она разместила незваного гостя рядом со своими детёнышами, как «приемлемого гостя». *

Новый кот для новой проблемы

В этот момент, почти одновременно, моя жена и я заявили, что это видео, вероятно, сгенерировано ИИ, и выразили то, что я могу назвать «подвешенным разочарованием»; для нас это был буквально новый вид кота Шрёдингера — наконец‑то «из коробки», но не обязательно живой.

Я с тех пор не искал это видео, чтобы проверить, признали ли его авторы подлинность; или было ли оно впервые опубликовано до текущего времени, до того как такой контент можно было бы за копейки создать на множестве сайтов и порталов; или же посмотреть, как комментаторы видео обвиняют материал в генерации ИИ, даже если они не уверены в этом.

То, было ли конкретное видео поддельным или реальным, не имеет значения; меня поразило то, что я наконец достиг долгожданного озарения — несмотря на то, что я уже семь лет предоставляю глубокое и интенсивное покрытие** систем генерации изображений и видео ИИ (а также обсуждаю и создание систем обнаружения дипфейков) за семь лет, даже я больше не могу доверять тому, что вижу.

Самым большим оставшимся узким местом в синтезе AI‑видео является несоответствие — но это не препятствие для создания того рода короткого контента, наиболее вероятно становящегося вирусным. ИИ может идеально и точно заполнять наши сокращённые периоды внимания, и пока больше ничего; однако, очевидно, эти оговорки, сколь бы они ни были сложными, в конечном итоге будут преодолены.

Следовательно, эта запоздалая (и, возможно, ошибочная) мысль о видео с коалой вписывается в череду моментов «где я был»: Мама поднимается по лестнице, крась потолок, а радио сообщает, что Элвис умер; звёздный разрушитель гремит над головой в канун Рождества 1977 года на публичной премьере в Лестер‑сквер фильма Star Wars; Т‑Рекс вырывается из своего вольера, снова в Лестер‑сквер, в июле 1993 года; Мара говорит (по‑итальянски) «Зайдите на кухню, ребята — в Нью‑Йорке что‑то происходит»; Я смотрю на кота в видео с коалой и понимаю, что это год, и — для меня — момент, когда реальность умерла.

(Эй, даже я был за пределами Земли, когда Кеннеди был застрелен.)

Ответ «Враг у ворот»

К концу 2025 года, по словам одного исследователя, наша способность распознавать изображения, сгенерированные ИИ, не намного превышает случайность, составляя 54 %. Попробуйте тест сами — у меня не получилось хорошо, а качество генеративного ИИ заметно улучшилось за последующие восемь‑девять месяцев:

Нажмите, чтобы воспроизвести – Несмотря на годы исследований, оценивая изображения как сгенерированные ИИ или реальные, я получаю почти точно такой же средний результат, как в тестах, проведённых для указанного исследования. Source 

The Washington Post сделала одно из первых предсказаний потенциального постреального мира в феврале 2018 года, всего через пару месяцев после того, как автокодировочные дипфейки впервые поразили мир. Статья быстро превратилась в тревожный призыв к регулированию, который впоследствии принял форму законодательства против сексуальных дипфейков; нового закона ЕС о раскрытии материалов, сгенерированных ИИ; и системы аутентификации Coalition for Content Provenance and Authenticity (C2PA).

Последняя пытается прикреплять квалифицирующую информацию к изображениям на протяжении их жизненного цикла, от данных датчика камеры до публикации и архивирования, фиксируя любые изменения, внесённые в процессе, и соответствующим образом корректируя их манифест.

Естественно, такой подход от «колыбели до могилы» в значительной степени игнорирует существующий массив изображений в обороте и имеет потребительскую ценность лишь в очень ограниченном числе мест, где она была принята.

Сколько пальцев я поднимаю?

Суть в том, что аппетит к регулированию контента, сгенерированного ИИ, который вырос огромными темпами с тех ранних, импульсивных статей 2018 года, иронично представляет собой призыв к автоматизации или делегированию человеческого суждения.

Либо мы не хотим выполнять эту работу и хотим, чтобы правительства и институты делали её за нас; либо мы считаем, что определённые другие люди — или типы людей — не должны принимать такие решения (позиция, которой нельзя похвастаться).

Разве я уже не говорил, возможно, слегка уныло, что не буду расследовать происхождение видео с коалой и котом? Не зная, поддельно ли это видео, и не желая собрать достаточно информации, чтобы хотя бы предположить более обоснованную догадку, я остаюсь в том же состоянии упругой веры, которое Джордж Оруэлл описывает в 1984, где главный герой подвергается пыткам полицейского государства, пока не становится психологически способным держать две противоречивые убеждения:

From Michael Radford's 1984 adaptation of Orwell's classic dystopian SF novel, a tormented Winston Smith (John Hurt) begins to at least concede that four fingers might actually equal three fingers, and that his eyes are not to necessarily be trusted. Still from 1984 (1984), © Metro-Goldwyn-Mayer Studios Inc. / Amazon MGM Studios.

Из экранизации 1984 Майкла Рэдфорда, классического дистопического научно‑фантастического романа Оруэлла, измученный Уинстон Смит (Джон Херт) начинает, по крайней мере, признавать, что четыре пальца могут фактически равняться трем пальцам, и что его глаза не всегда заслуживают доверия. Кадр из 1984 (1984), © Metro‑Goldwyn‑Mayer Studios Inc. / Amazon MGM Studios.

В романе Оруэлла антагонист О’Брайен (в исполнении Ричарда Бертона в экранизации 1984, изображённой выше) явно заявляет своим жертвам, что цель пыток — сделать их убеждения гибкими, чтобы они могли — как это удобно тоталитарному государству, описанному в произведении — одновременно держать две веры, например, что поднятые четыре пальца могут также означать три пальца, если этого требует Государство.

Эта «эластичность убеждений» естественно ценится среди инфлюенсеров всех видов, поскольку к моменту, когда избиратели — или потребители — становятся желанными целями для влияния, такие гибкие взгляды обычно уже окаменели.

Поскольку для меня видео с коалой и котом одновременно и «ИИ», и «не ИИ», я сделал первые шаги к привычке к двойному убеждению; и стал восприимчив к тем, кто предлагает прекратить эту мерцающую, бинарную оценку и сказать мне, что реально.

Следовательно, мне кажется, что это конкретное озарение не должно цениться, а наоборот, его следует отвергать. Это внутреннее признание «нереальности», пришедшее ко мне в виде видео «милые животные», и которое может прийти к вам — или ещё придёт к вам — в иной форме, по сути представляет опасность для способности судить и оценивать мир.

В более лёгком тоне

В более лёгком тоне философ Джошуа Хабгуд‑Кут в 2024 году занял более оптимистичную позицию, отбрасывая «эпистемический апокалипсис» как паникерство вокруг утраты систем, которые в любом случае были хрупкими, а в случае фотографии — довольно новыми.

Но он также утверждает в более недавнем выступлении, что мемы «фейковые новости» и «постправда» были использованы как оружие в политических целях, что, по крайней мере в первом случае, трудно отрицать (даже если это проявление политического opportunismа, а не заговора).

 

* И, действительно, задаётесь ли вы вопросом, реален ли этот удобный пример, или я придумал его — с ИИ или без — как дискурсивный приём? Я говорю, что он реальный; если факт, что я не новый голос в этих вопросах имеет значение, возможно, вы мне поверите. Или я недавно изменился..?

** Это включает цитаты в различных записях литературы, включая The Cambridge Handbook of Generative AI and the Law (для «Weights in Machine Learning»).

Первоначально опубликовано в пятницу, 4 сентября 2026 года. Исправлено через несколько минут после первой публикации из‑за ошибок, связанных с коалами; а чуть позже в тот же день добавлены недостающие теги.

Писатель о машинном обучении, специалист в области синтеза человеческого изображения. Бывший руководитель исследовательского контента в Metaphysic.ai, до его распада в DNEG's Brahma.ai.
Портфолио: martinanderson.ai
Контакт: martin@martinanderson.ai