Погляд Anderson
Китай пропонує посилений контроль над deepfakes та іншими системами синтезу штучного інтелекту
Управління кіберпростору Китаю (CAC) запропонувало новий набір проєктів правил, які регулюватимуть системи синтезу штучного інтелекту, включаючи deepfakes, віртуальну реальність, генерацію тексту, аудіо та інші підгалузі медіа-синтезу штучного інтелекту – галузі, в якій Китай видає величезну кількість наукових статей і інноваційних дослідницьких проєктів кожному місяцю.
Пост (Google Translation, оригінал тут) на офіційному сайті CAC викладає запропоновані зобов’язання та характеризує постраждалі послуги як “постачальники послуг глибокого синтезу”, запрошуючи громадян брати участь, надсилаючи коментарі до проєктів правил, з терміном 28 лютого.
Не тільки deepfakes
Хоча запропоновані правила були повідомлені у термінах їхнього потенційного впливу на створення та поширення deepfakes, документ намагається охопити всі можливі види вмісту, який може бути інтерпретований у широкому сенсі як “медіа”.
Стаття 2 проголошує проєктований обсяг правил у шести секторах*:
(1) Техніки генерації або редагування текстового вмісту, таких як генерація розділів, конвертація текстового стилю та діалогових питань;
(2) Технології генерації або редагування голосового вмісту, таких як текст-у-голос, конвертація голосу та редагування голосових атрибутів;
(3) Технології генерації або редагування невокального вмісту, таких як генерація музики та редагування звукових сцен;
(4) Генерація обличчя, заміна обличчя, редагування атрибутів персонажа, маніпуляція обличчями, маніпуляція жестикуляцією та інші технології генерації або редагування біометричних ознак, таких як обличчя в зображеннях та відео;
(5) Техніки редагування небіологічних ознак у зображеннях та відео, таких як покращення зображення та відновлення зображення;
(6) Технології генерації або редагування віртуальних сцен, таких як 3D-реконструкція.
Регуляція deepfakes
Китай криміналізував використання штучного інтелекту для поширення фейкових новин у кінці 2019 року, на той час CAC висловив занепокоєння щодо потенційних наслідків технології deepfakes, що спонукало багатьох вважати, що китайський уряд врешті-решт заборонить технологію deepfakes зовсім.
Однак, це означало б, що Китай офіційно відмовиться від одного з найбільш політично та культурно значимих розробок в історії генерації медіа, штучного інтелекту та навіть політики, та відріже себе від переваг відкритої наукової співпраці.
Отже, здається, що Китай тепер вирішив експериментувати з контролем, а не з заборонами потенційно злої технології, яку багато хто вважає врешті-решт мігрує з її фази прискорення порнографії у легітимну та використовувану сукупність випадків використання, особливо у сфері розваг.
NeRF включено
Стаття 2.6 стосується генерації або редагування віртуальних сцен, таких як 3D-реконструкція, більш молодої технології, ніж імперсонація deepfakes, та однієї з найбільш відомих технологій за останні два роки завдяки появі Нейронних радіаційних полів (NeRF), де фотограмметрія використовується для синтезу цілих сцен у латентному просторі моделей машинного навчання.
Однак, NeRF швидко розширює свій вплив за межі моделей та навколо середовищ у генерацію повного відео, причому китайські дослідники зробили декілька великих інновацій у цьому відношенні.

Китайський ST-NeRF у дії.
Хоча NeRF викликав цілу низку нових досліджень з моменту його оголошення у 2020 році, його впровадження у системи віртуальної чи доповненої реальності, або його придатність у візуальних ефектах, все ще має багато відомих викликів та технологічних瓶лочок. Ріст NeRF у khảсті відновлення та редагування повних людських фізіономій ще не включає жодної зі стандартних можливостей трансформації ідентичності deepfakes, які характеризували заголовки новин за останні два роки.
Аудіо deepfakes – пріоритет?
Якщо вважати, що порядок списку статті 2 вказує на глибокі синтезні технології, які Китай найбільш турбує контролювати та регулювати, це означало б, що текстові штучні новини є першочерговим завданням, а синтез голосу попереду відео deepfakes за потенційним впливом.
Якщо так, це узгоджується з тим фактом, що відео deepfakes ще не були використані у будь-якому злочині, не пов’язаному з порнографією (Азія не завагалася криміналізувати порно deepfakes), тоді як аудіо deepfakes були використані у двох великих фінансових злочинах, у Великій Британії у 2019 році, та у Об’єднаних Арабських Еміратах у 2021 році.
Нові проєкти правил зобов’язують користувачів, які бажають використати особу через використання систем машинного навчання, шукати письмову згоду особи. Крім того, синтезовані медіа повинні відображати якийсь “помітний” логотип або водяний знак, або інші засоби, за допомогою яких споживач матеріалу може бути повідомлений про те, що вміст змінений або повністю сфабрикований. Не зовсім зрозуміло, як це можна зробити у випадку аудіо deepfakes.
Реєстрація
Якщо проєкти правил будуть ратифіковані, вони зобов’язуватимуть постачальників глибокого синтезу реєструвати свої відповідні програми в державі, згідно з існуючими положеннями про адміністрацію алгоритмічних рекомендацій для інтернет-інформаційних послуг, та виконувати всі необхідні процедури реєстрації. Постачальники глибокого синтезу також будуть зобов’язані співпрацювати у питаннях нагляду та інспекції, та надавати “необхідну технічну та дані підтримку та допомогу” на запит.
Крім того, такі постачальники повинні створити зручні портали для скарг, та опублікувати очікувані терміни розгляду скарг, а також бути зобов’язаними пропонувати “механізми спростування чуток” – хоча проєкти правил не надають подробиць щодо реалізації цього.
Порушення можуть спричинити штрафи від 10 000 до 100 000 юанів ($1 600 і $16 000), а також можуть піддати компанії, які порушують правила, цивільним та кримінальним позовам.
* Переклад Google Translate, див. посилання на початку статті.
Перше опубліковано 28 січня 2022 року.












