Погляд Anderson

Про етику Голлівудських дипфейків

mm
Додайте Unite.AI до бажаних джерел у Google
AI-generated image, GPT-2. A distracted Dr. Frankenstein reads intently beside a shrouded body on a laboratory bench, unaware that the creature’s exposed, decaying hand is beginning to rise, signaling a return to life amid crackling electrical apparatus.

Чому останнім часом спостерігається спад у кількості телевізійних і кінодипфейків? Автор працював у компанії Metaphysic.ai, піонері кінодипфейків, понад два з половиною роки, включаючи 20 місяців як повноцінний працівник.

 

Опінія/Фічер Як дитина, я був захоплений історіями про заснування компанії Industrial Light and Magic (ILM), яка працювала у простому складі у Ван-Нуйсі, і ретельно будувала нове покоління методів візуальних ефектів, які згодом домінували у більшості 1980-х років, аж до появи CGI.

Вибухання частини Зірки Смерті на подвір'ї ILM у Ван-Нуйсі в середині 1970-х років. Джерело - https://www.ilm.com/ilms-audacious-start-in-an-empty-warehouse-began-50-years-ago/

Вибухання частини Зірки Смерті на подвір’ї ILM у Ван-Нуйсі в середині 1970-х років. Джерело

Це видатна історія походження, і я рекомендую багато книг і статей, які переповідають, як ефекти для Зоряних війн (1977) були – після великої праці, докорів і затримок – врешті-решт доставлені.

Молодша ILM пізніше переїхала до Сан-Франциско і пішла на індустріалізацію виробництва фотохімічних ефектів. Навіть під час роботи над візуальними ефектами для Імперія завдає удар у відповідь у 1978/9 роках, ILM, хоча і була все ще піонерською та інноваційною компанією візуальних ефектів, вже була переповнена бухгалтерськими та кадровими відділами.

Але в той період, і з тих пір, моя уява була захоплена тим, яким були ті перші “сирі” роки у Ван-Нуйсі, канібалізуючи набори моделей і методи оптики 1960-х років, і практично винаходячи індустрію, яка раніше була збережена для індивідуальних автора спеціалістів візуальних ефектів.

Обличчя революції

Під час майже трьох років, які я працював у компанії Metaphysic.ai, я думаю, що я прийшов якнайближче до досвіду середини 70-х років у Ван-Нуйсі.

За цей час Metaphysic створила ефекти, керовані штучним інтелектом, для деяких з найбільших франшиз, включаючи Мад Макс і Чужий франшизи, а також створила піонерську (хоча критиковану) роботу з омолодженням дипфейків для фільму Роберта Земекіса Тут (2024), і багато інших робіт:

Було більше зустрічей “дейлі” (показу останньої знятої плівки, у переповнених зустрічах Zoom) ніж будь-яка одна людина могла б розсудливо відвідувати і все ж таки виконувати свою роботу, а також зустрічі типу “сканків”, де вибрані групи працювали разом над міні-проектами, щоб просунути компанію до нового рівня.

Багато співробітників прийшли до компанії безпосередньо з ILM або працювали в ILM у минулому*; і хоча було зрозуміло, з анекдотів, що дух Ван-Нуйса давно вже відійшов у минуле у великих будинках візуальних ефектів, таких як ILM, і інших великих будинках візуальних ефектів, звідки прийшли деякі співробітники, асоціація залишилася електрично для мене.

Джордж Лукас переглядає ефекти з Джоном Дікстрою, Річардом Едлундом, Джо Джонстоном і Роуз Дуігнан під час виробництва Зоряних війн, коли команда працює над практичними візуальними ефектами і дизайном кадрів. Джерело - https://theasc.com/articles/star-wars-miniature-effects-dykstra

Джордж Лукас переглядає ефекти з Джоном Дікстрою, Річардом Едлундом, Джо Джонстоном і Роуз Дуігнан під час виробництва Зоряних війн. Джерело

Я не знаю, чи можна сказати, що Metaphysic створила щось подібне до Дікстрофлекс рухом-контрольної системи, яка вийшла з Ван-Нуйського сарайного будинку; але вона поставила візуальні ефекти, керовані штучним інтелектом, на карту, і була відповідальною за більше професійних заміни обличчя і зміни, ніж будь-яка інша компанія візуальних ефектів або окремий проект у цьому періоді, або після нього.

Затримка

І я повинен зазначити, що після того, як компанія була поглинута компанією Brahma AI, постійний потік робіт візуальних ефектів, керованих штучним інтелектом, здається, сповільнився до мінімуму.

Незважаючи на заголовки, такі як партнерство Бена Аффлека з AI VFX Netflix, і зобов’язання щодо штучного інтелекту від режисерів Содерберга і Аронофського, я не бачив багато дипфейкових облич у фільмах і на телебаченні останнім часом (окрім Симуляції дипфейкової технології у фільмі “Захоплення”).

Враховуючи масштаб затримки штучного інтелекту у багатьох галузях і секторах, я задаюсь питанням, чи не починаємо ми всі читати кімнату щодо штучного інтелекту в ідентичностях; і чи не починаємо ми бачити, що зусилля, такі як воскресіння Іана Холма, омолодження Гаррісона Форда і воскресіння Рат Пека для продажу джину, можуть скоро викликати класичну мему ‘Це було інший час’.

Негативні асоціації

У багатьох аспектах це проблема асоціації; але це не та сама проблема асоціації, яку було у 2021 році, коли Metaphysic була створена.

У той час дипфейковий порно став вірусним явищем, з усіма SFW і NSFW виходами, що походили з одного з двох відкритих джерел програмного забезпечення. На відміну від сьогодні, не було “закритого” або цензурного способу виробництва фотореалістичного контенту штучного інтелекту.

Тоді найбільший сайт дипфейкового порно у світі (призначений для закриття у 2025 році) був там, де були офіційні інструкції для найбільшого репозиторію програмного забезпечення дипфейків, DeepFaceLab, яке було визнане основою оригінальних підходів Metaphysic:

Оригінальне керівництво до DeepFaceLab, яке було найбільш популярним програмним забезпеченням дипфейків - розміщене на найбільшому сайті дипфейкового порно. Відтоді програмне забезпечення було архівовано, а сайт закрито. Джерело - https://web.archive.org/web/20210203195545/https://mrdeepfakes.com/forums/thread-guide-deepfacelab-2-0-guide

Оригінальне керівництво до DeepFaceLab, яке було найбільш популярним програмним забезпеченням дипфейків – розміщене на найбільшому сайті дипфейкового порно. Відтоді програмне забезпечення було архівовано, а сайт закрито. Джерело

Після того, як розробники програмного забезпечення не уникнули асоціації між порно і дипфейками, це неминуче вплинуло на будь-яку компанію, яка намагалася легітимно采用 цю технологію.

Відповідно (можливо, не в останню чергу тому, що засновник компанії був включений до авторства статті про дипфейки в 2020 році, і був підданий критиці через ці асоціації) Metaphysic мала спеціальний відділ етики, і компанія була громкою і дуже публічною щодо цієї теми.

Ці дні, з великою і розростаючою кількістю законодавчих актів, які криміналізують контент дипфейків, ця “нещасна” асоціація щодо штучно створених ідентичностей перейшла від порно до бідності, оскільки глобальні робочі сили, які безпосередньо загрожують різним видам штучного інтелекту (зазвичай великими мовними моделями, або LLM), починають демонізувати термін у цілому.

Селяни повстали

У певний момент, можливо, у середині 2023 року, відвідуючи різні зустрічі компанії, я почав відчувати, хоча б опосередковано, зростаючу хвилю неформальної ад хок опору проти послуг, які надавала компанія, що збігалося з першими соціальними хвилями навколо штучного інтелекту як існуючої загрози для працівників (хоча потрібно зазначити, що голлівудські профспілки були в авангарді у цьому відношенні).

Штучний інтелект здавався сприйматимим у деяких кварталах як “не вартий ризику”. Крім того, у період найбільшої активності Metaphysic ніколи не мала недвозначного хіту після шокової цінності молодого Елвіса Преслі в America’s Got Talent. Насправді, жодна інша компанія, яка виводила контент, згенерований штучним інтелектом, у головних фільмах і телевізійних роботах, не мала такого хіту.

Завжди здавалося, що є якась причина ненавидіти: постійно присутня долина нещастя; асоціація з порно; і потім, асоціація з загрозою штучного інтелекту економічної апокаліпсису.

‘Тираннозавровий момент’ штучного інтелекту

Мені здавалося, що протягом довгого часу, створення людини з 100% вірогідністю у контексті візуальних ефектів, яке було провалено комп’ютерною графікою протягом довгого часу, було гідною, якщо не неминучою, метою.

Я уявляв, що еволюція штучного інтелекту у візуальних ефектах призведе до третього “епохального” моменту для індустрії, до задоволення глядачів. Перший був перший погляд на зірку-руйнівник, який громить над головою у Зоряних війнах у 1977 році, і другий, тираннозавр, який втікає з свого загону у Парку Юрського періоду, у 1993 році.

Кожен з них привів до радикальних змін у індустрії, і кожен був попереджений ранніми приймающими, які 推али межі нової технології або методу.

Отже, здавалося мені, що потік випусків Metaphysic, хоча і не забезпечував глядачів тим “тираннозавровим моментом”, неминуче призведе до нього; що одного дня ми побачимо щось неможливе у фільмі; щось фундаментально створене штучним інтелектом (а не закритим комп’ютерною графікою), що вибije нам подих.

Тепер… я не знаю. Це не означає, що я не вірю, що момент здивування прийде для штучного інтелекту у кіно; ні того, що є багато критичних питань для відео штучного інтелекту, які потрібно подолати, перш ніж він зможе приєднатися до професіоналів за столом.

Це більше того, що я почав поділяти, у певній невизначеній (і, можливо, морально боязкій) спосіб, зростаюче публічне почуття негативної асоціації між штучним інтелектом у візуальних ефектах і негативними наслідками штучного інтелекту в інших секторах, у цьому періоді.

Окрім цього, я не зараз переконаний, що історична впливність незаплатних і некомерційних наборів даних, таких як Common Crawl, була真正 облікована ще; і я вважаю, що багато з тих, хто прославляє угоди про ліцензування штучного інтелекту, які зробили заголовки за останні 18 місяців або близько того, представляють певний рівень виведення інтелектуальної власності.

Отже, момент, коли ідеально регенерований Марлін Монро або Гемфрі Богарт вийде на екран, я думаю, що подвійні почуття здивування і незручності, ймовірно, виникнуть у мене, оскільки багаж чарівництва штучного інтелекту почав давити на мене.

Висновок

Дві попередні технологічні прориви прийшли без таких застережень: появу ILM і рухом-контрольних систем фактично винайшла індустрію, яка раніше була серією спорадичних замовлень, виконуваних рідкісним елітом ад хок фрілансерів; і появу комп’ютерної графіки значно збільшувала кількість робочих місць у індустрії візуальних ефектів і створювала цінність у суміжних розробках програмного забезпечення, а також у різних підтримуючих послугах.

Мій інтерес до комп’ютерного зору залишається цілим, разом з моїм інтересом до потенціалу штучного інтелекту у широкому спектрі можливих аудіовізуальних застосунків; і мій ентузіазм щодо ширших застосунків машинного навчання у різних інших секторах залишається незмінним.

Я тільки бажаю, щоб я міг продовжувати чекати того моменту “вау” штучного інтелекту у кіно.

Що ж до причини, чому зараз спостерігається раптова нестача згенерованих штучним інтелектом облич у фільмах і на телебаченні, порівняно з найбільш активними роками Metaphysic – одна з можливостей полягає в тому, що тепер коригування, здійснені за допомогою штучного інтелекту, застосовуються продюсерськими компаніями з мінімальною публічністю (у порівнянні з гучними прес-релізами періоду 2022-23 років), оскільки публічна реакція на інновації штучного інтелекту у розважальному секторі останнім часом стала дуже ворожою.

Другою причиною є те, що після AGT, де компанія зробила свій дебют, Metaphysic ніколи не мала недвозначного хіту щодо свого внеску у будь-який фільм або телешоу; і жодна з інших робіт інших продюсерських компаній не була достатньо добре прийнята, щоб запустити хвилю копіювань, або щоб надати штучному інтелекту у візуальних ефектах справжню кредибілітетність і привабливість для інвесторів.

 

* Це легко перевірити, просто переглянувши публічно доступні профільні сторінки LinkedIn і дані IMDB.

DeepFaceLab, і менше асоційоване з порно FaceSwap.

Перша публікація понеділка, 27 квітня 2026 року

Письменник про машинне навчання, спеціаліст у галузі синтезу людських зображень. Колишній керівник дослідницького контенту в Metaphysic.ai, до його розформування в DNEG's Brahma.ai.
Портфоліо сайт: martinanderson.ai
Контакт: martin@martinanderson.ai