Góc nhìn Anderson

Trung Quốc Đề Xuất Tăng Cường Quy Định Về Deepfakes và Các Hệ Thống Tổng Hợp AI Khác

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Cơ quan Quản lý Không gian Mạng của Trung Quốc (CAC) đã đề xuất một bộ quy định mới để quản lý các hệ thống tổng hợp AI, bao gồm deepfakes, cảnh ảo, tạo văn bản, âm thanh và các phân khúc khác của tổng hợp truyền thông AI – một lĩnh vực mà Trung Quốc sản xuất một số lượng lớn các bài báo học thuật và dự án nghiên cứu đổi mới mỗi tháng.

Một bài đăng (Google Translation, bản gốc tại đây) trên trang web chính thức của CAC đã nêu ra các nghĩa vụ được đề xuất và mô tả các dịch vụ bị ảnh hưởng là ‘cung cấp dịch vụ tổng hợp sâu’, mời công dân tham gia bằng cách đóng góp ý kiến về các đề xuất dự thảo, với thời hạn là ngày 28 tháng 2.

Không Chỉ Là Deepfakes

Mặc dù các quy định được đề xuất đã được báo cáo về tác động tiềm năng của chúng đối với việc tạo ra và lan truyền deepfakes, nhưng tài liệu này cố gắng có một phạm vi bao quát tất cả khả năng của các thuật toán để tạo ra bất kỳ loại nội dung nào có thể được hiểu theo nghĩa rộng của ‘truyền thông’.

Điều 2 tuyên bố phạm vi dự kiến của các quy định trên sáu lĩnh vực*:

(1) Các kỹ thuật để tạo hoặc chỉnh sửa nội dung văn bản, chẳng hạn như tạo chương, chuyển đổi phong cách văn bản và đối thoại hỏi và đáp;

(2) Các công nghệ để tạo hoặc chỉnh sửa nội dung giọng nói, chẳng hạn như văn bản thành giọng nói, chuyển đổi giọng nói và chỉnh sửa thuộc tính giọng nói;

(3) Các công nghệ để tạo hoặc chỉnh sửa nội dung không phải giọng nói, chẳng hạn như tạo nhạc và chỉnh sửa âm thanh cảnh;

(4) Tạo khuôn mặt, thay thế khuôn mặt, chỉnh sửa thuộc tính nhân vật, thao túng khuôn mặt, thao túng cử chỉ và các công nghệ khác để tạo hoặc chỉnh sửa các đặc điểm sinh trắc học như khuôn mặt trong nội dung hình ảnh và video;

(5) Các kỹ thuật để chỉnh sửa các đặc điểm không sinh học trong nội dung hình ảnh và video, chẳng hạn như tăng cường hình ảnh và phục hồi hình ảnh;

(6) Các công nghệ để tạo hoặc chỉnh sửa các cảnh ảo như tái tạo 3D.

Quy Định Về Deepfakes

Trung Quốc đã hình sự hóa việc sử dụng AI để lan truyền tin giả vào cuối năm 2019, tại thời điểm đó, CAC đã bày tỏ lo ngại về các ý nghĩa tiềm tàng của công nghệ deepfake, khiến nhiều người cho rằng chính phủ Trung Quốc sẽ cuối cùng cấm công nghệ deepfake.

Tuy nhiên, điều này sẽ khiến Trung Quốc chính thức từ bỏ một trong những phát triển quan trọng nhất về mặt chính trị và văn hóa trong lịch sử tạo ra truyền thông, AI và thậm chí chính trị, và cắt đứt mình khỏi các lợi ích của sự hợp tác khoa học toàn cầu và cởi mở.

Do đó, dường như Trung Quốc hiện đang quyết tâm thử nghiệm việc kiểm soát thay vì cấm công nghệ có khả năng đi awry, công nghệ mà nhiều người tin rằng cuối cùng sẽ di chuyển ra khỏi giai đoạn tăng tốc cho người lớn và vào một tập hợp các trường hợp sử dụng hợp pháp và có thể khai thác, đáng chú ý trong giải trí.

NeRF Được Bao gồm

Điều 2.6 đề cập đến việc tạo hoặc chỉnh sửa các cảnh ảo, chẳng hạn như tái tạo 3D, một công nghệ non trẻ hơn so với giả mạo deepfake, và một công nghệ đã đạt được sự nổi bật nhất trong hai năm qua thông qua sự ra đời của các Trường Neuron Radiance (NeRF), nơi photogrammetry được sử dụng để tổng hợp toàn bộ cảnh trong không gian ẩn của các mô hình học máy.

Tuy nhiên, NeRF đang nhanh chóng mở rộng phạm vi của mình từ các mô hình và hướng dẫn môi trường vào việc tạo ra video toàn thân, với các nhà nghiên cứu Trung Quốc đã đạt được một số đổi mới quan trọng trong khía cạnh này.

ST-NeRF

Trung Quốc’s ST-NeRF trong hành động.

Mặc dù NeRF đã tạo ra một cơn bão mới về nghiên cứu kể từ khi nó được công bố vào năm 2020, nhưng việc triển khai nó trong các hệ thống VR hoặc AR, hoặc sự phù hợp của nó trong các đường ống hiệu ứng hình ảnh, vẫn còn nhiều thách thức và nút thắt công nghệ đáng kể để vượt qua. Khả năng ngày càng tăng của NeRF trong việc tái tạo và chỉnh sửa toàn bộ hình dáng con người vẫn chưa kết hợp bất kỳ khả năng biến đổi danh tính tiêu chuẩn nào của deepfake đã đặc trưng cho các tiêu đề tin tức trong hai năm qua.

Audio Deepfakes Là Ưu Tiên?

Nếu chúng ta coi danh sách thứ tự của Điều 2 là một dấu hiệu của các công nghệ tổng hợp sâu mà Trung Quốc quan tâm nhất để kiểm soát và quy định, điều này sẽ cho thấy rằng tin giả AI tạo ra dựa trên văn bản là mối quan tâm chính, với tổng hợp giọng nói đứng trước deepfakes video về tác động tiềm tàng.

Nếu vậy, điều này phù hợp với thực tế rằng video deepfake vẫn chưa được sử dụng trong bất kỳ tội phạm nào không liên quan đến khiêu dâm (Châu Á đã không ngần ngại hình sự hóa deepfake khiêu dâm), trong khi deepfake âm thanh đã được đề xuất là một công nghệ hoạt động trong ít nhất hai tội phạm tài chính lớn, ở Anh vào năm 2019, và ở Các Tiểu vương quốc Ả Rập Thống nhất vào năm 2021.

Các quy định dự thảo mới yêu cầu người dùng muốn khai thác danh tính của một người thông qua việc sử dụng các hệ thống học máy phải xin phép viết từ người đó. Ngoài ra, truyền thông tổng hợp phải hiển thị một số loại logo hoặc watermark ‘đáng chú ý’ hoặc các phương tiện khác để người tiêu dùng có thể hiểu rằng nội dung đã được thay đổi hoặc hoàn toàn tạo ra. Hiện chưa rõ làm thế nào điều này có thể được thực hiện trong trường hợp của deepfakes âm thanh.

Đăng Ký

Nếu được thông qua, các đề xuất dự thảo sẽ yêu cầu các nhà cung cấp dịch vụ tổng hợp sâu đăng ký các ứng dụng liên quan với nhà nước, theo Quy định về Quản lý Khuyến nghị Thuật toán cho Dịch vụ Thông tin Internet, và tuân thủ tất cả các thủ tục nộp đơn cần thiết. Các nhà cung cấp tổng hợp sâu cũng sẽ phải hợp tác tự do trong việc giám sát và kiểm tra, và cung cấp ‘hỗ trợ kỹ thuật và dữ liệu cần thiết’ khi được yêu cầu.

Ngoài ra, các nhà cung cấp này sẽ cần thiết lập các cổng thông tin dễ sử dụng cho khiếu nại, và xuất bản các giới hạn thời gian dự kiến về việc xử lý các khiếu nại, cũng như phải cung cấp ‘cơ chế phản bác tin đồn’ – mặc dù các đề xuất không cung cấp chi tiết về việc thực hiện điều này.

Vi phạm có thể dẫn đến phạt từ 10.000 đến 100.000 nhân dân tệ (1.600 và 16.000 USD), cũng như khiến các công ty vi phạm phải đối mặt với các vụ kiện dân sự và hình sự.

 

* Dịch bởi Google Translate, xem liên kết đầu bài.

Được xuất bản lần đầu vào ngày 28 tháng 1 năm 2022.

Nhà văn về học máy, chuyên gia lĩnh vực tổng hợp hình ảnh con người. Cựu trưởng nhóm nội dung nghiên cứu tại Metaphysic.ai, cho đến khi nó được併 nhập vào Brahma.ai của DNEG.
Portfolio site: martinanderson.ai
Contact: martin@martinanderson.ai