Погляд Anderson
Google заборонив навчання глибоких підробок у Colab

Десь за останні два тижні Google тихо змінив умови використання для своїх користувачів Colab, додавши пункт, згідно з яким послуги Colab більше не можуть бути використані для навчання глибоких підробок.

Оновлення травня вводить заборону на навчання глибоких підробок у Colab. Джерело: https://research.google.com/colaboratory/faq.html#limitations-and-restrictions
Перша веб-архівна версія з Інтернет-архіву, яка містить заборону на навчання глибоких підробок, була записана у вівторок, 24 травня. Остання записана версія часто запитань Colab, яка не зазначає заборону, була на 14 травня.
З двох популярних розподілів для створення глибоких підробок, DeepFaceLab (DFL) і FaceSwap, обидва з яких є форками суперечливого та анонімного коду, опублікованого на Reddit у 2017 році, тільки більш скандальний DFL, як видається, був безпосередньо націлений забороною. За словами розробника глибоких підробок ‘chervonij’ у Discord DFL, виконання програми в Google Colab тепер генерує попередження:
‘Ви можете виконувати код, який заборонено, і це може обмежити вашу можливість використовувати Colab у майбутньому. Будь ласка, зверніть увагу на заборонені дії, зазначені в нашому FAQ.’
Однак цікаво, що користувач зараз дозволено продовжувати виконання коду.

Нове попередження, яке зустріло користувачів DFL, які спробували запустити код у Google Colab. Джерело: https://discord.com/channels/797172242697682985/797391052042010654/979823182624219136
За словами користувача у Discord для конкуруючого розподілу FaceSwap, код цього проекту, як видається, ще не викликає попередження, що свідчить про те, що код для DeepFaceLab (також архітектуру для реалізації потокового навчання глибоких підробок DeepFaceLive), найпоширеніший метод глибоких підробок, був спеціально націлений Colab.
Ко-лідер розробника FaceSwap Метт Тора прокоментував*:
‘Я вважаю дуже малоймовірним, що Google робить це з якихось особливих етичних причин, а радше тому, що Colab існує для того, щоб студенти/дослідники могли виконувати обчислювально дорогий код на потужних GPU безкоштовно. Однак я підозрюю, що не незначна кількість користувачів використовують цю можливість для створення глибоких підробок у великому масштабі, що обчислювально дорого і потребує значного часу навчання для отримання результатів.
‘Ви можете сказати, що Colab орієнтований більше на освітню, дослідницьку сторону штучного інтелекту. Виконання скриптів, які потребують мало користувацького вводу, ні розуміння, суперечить цьому. У FaceSwap ми намагаємося зосередитися на освіті користувача в галузі штучного інтелекту та механізмів, які ним керують, а також знижувати бар’єр для входу. Ми дуже заохочуємо етичне використання програмного забезпечення та вважаємо, що надання таких інструментів ширшій аудиторії допомагає людям зрозуміти, чого можна досягти в сучасному світі, а не тримати це прихованим для вибраної групи.
‘На жаль, ми не можемо контролювати, як наші інструменти будуть використовуватися в кінцевому підсумку, ні де вони будуть виконуватися. Це засмучує мене, що одна з можливостей для експериментів з нашим кодом була закрита, однак щодо захисту цієї ресурсу для забезпечення його доступності справжній цільовій аудиторії, я вважаю це зрозумілим.’
Не існує доказів того, що новий обмеження обмежується тільки безкоштовним тарифом Google Colab – унизу списку заборонених дій, до яких тепер додані глибокі підробки, є примітка ‘Додаткові обмеження існують для платних користувачів’, що свідчить про те, що ці обмеження є базовими правилами. Що стосується заборони глибоких підробок, це викликало плутанину в деяких, оскільки ‘видобуток криптовалюти’ і ‘участі в пірінговому файловому обміні’ включені як до безкоштовного, так і до платного розділу “Обмеження”.
За цією логікою, все, що заборонено в безкоштовному розділі “Обмеження”, дозволено у версії Pro, якщо тільки версія Pro не явно забороняє це, включаючи ‘відмова у службі’ і ‘викрадення паролів’. Додаткові обмеження для тарифного плану Pro в основному стосуються заборони “підорювання” доступу до Pro Colab, незважаючи на плутанну та вибіркову дублікацію заборон.
Google Colab – це спеціалізована реалізація середовищ Jupyter notebook, які дозволяють віддалено тренувати проекти машинного навчання на набагато потужніших GPU, ніж можуть собі дозволити багато користувачів.
Відтак навчання глибоких підробок – це діяльність, яка потребує великої кількості відеопам’яті, і з моменту появи нестачі GPU багато deepfakers у останні роки відмовилися від навчання вдома на користь віддаленого навчання в Colab, де, залежно від випадку та тарифного плану, можна тренувати глибоку підробку на потужних картах, таких як Tesla T4 (16 ГБ відеопам’яті, зараз близько 2 тисяч доларів США), V100 (32 ГБ відеопам’яті, близько 4 тисяч доларів США) і могутній A100 (80 ГБ відеопам’яті, з ціною близько 32 тисяч доларів США), серед інших.
Заборона на навчання глибоких підробок у Colab, як видається, скоротить кількість deepfakers, які можуть тренувати високороздільні моделі, де вхідні та вихідні зображення більші, більш підходять для високороздільних результатів і здатні витягувати та відтворювати більшу кількість деталей обличчя.
Деякі з найбільш відданих хобі deepfakers та ентузіастів, згідно з повідомленнями у Discord та на форумах, вклали великі кошти у місцеве обладнання за останні пару років, незважаючи на високу ціну GPU.
Однак, враховуючи високу вартість, виникли субкультури для боротьби з проблемами навчання глибоких підробок у Colab, де випадкова видача GPU є найбільш поширеною скаргою з моменту, коли Colab обмежив використання вищої лінійки GPU для безкоштовних користувачів.
* У приватних повідомленнях на Discord
Опубліковано вперше 28 травня 2022 року.
Переглянуто о 7:28 ранку за східним часом, виправлено друкарську помилку у цитаті.
Переглянуто о 12:40 дня за східним часом – додано роз’яснення щодо заборон глибоких підробок для безкоштовного та платного тарифних планів, якнайкраще зрозуміло з “безкоштовного” та “платного” списків заборон.












