Quy định

OpenAI bắt đầu triển khai đánh dấu văn bản theo giai đoạn theo quy tắc EU AI Act

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

OpenAI vào ngày 5 tháng 10 năm 2026, đưa ra cách tiếp cận của mình đối với việc đánh dấu văn bản theo EU AI Act, mở tính năng đánh dấu theo lựa chọn cho khách hàng API trên toàn thế giới và công bố rằng các dấu mờ sẽ được thêm vào đầu ra văn bản của ChatGPT và Codex đủ điều kiện ở Liên minh Châu Âu trong vài tuần tới.

EU AI Act yêu cầu các nhà cung cấp AI sinh ra phải làm cho văn bản được tạo ra có thể nhận dạng được bằng cách máy đọc. OpenAI mô tả việc đánh dấu văn bản và phát hiện nó là các công nghệ sơ khai với những hạn chế đáng kể, và cho biết cách tiếp cận theo giai đoạn của mình phản ánh cả yêu cầu pháp lý và những giới hạn đó.

Tiếp cận API theo lựa chọn và triển khai khu vực EU

Từ ngày 5 tháng 10 năm 2026, khách hàng API trên toàn cầu có thể lựa chọn bật tính năng đánh dấu văn bản cho các mô hình được chọn, và cài đặt này mặc định là tắt. OpenAI cho biết thiết kế cho phép lựa chọn này giúp khách hàng quyết định cách đánh dấu phù hợp với nghĩa vụ minh bạch và trải nghiệm họ cung cấp cho người dùng, đồng thời công ty đang hợp tác với các đối tác đám mây để đưa tính năng đánh dấu sẵn sàng cho các đầu ra mô hình OpenAI được truy cập qua dịch vụ của họ trong vài tuần tới.

Đối với các sản phẩm của mình, OpenAI sẽ giới thiệu tính năng đánh dấu văn bản cho người dùng ChatGPT và Codex đủ điều kiện trên tất cả các gói chỉ ở Liên minh Châu Âu, cũng trong vài tuần tới. Công ty cho biết không đưa tính năng đánh dấu văn bản làm mặc định toàn cầu khi ra mắt và cách tiếp cận khu vực sẽ cho phép họ học hỏi từ việc sử dụng thực tế và phản hồi.

OpenAI cũng đã mở đơn đăng ký để truy cập bộ phát hiện đánh dấu văn bản của mình vào ngày 5 tháng 10 năm 2026. Quyền truy cập ban đầu sẽ chỉ giới hạn cho các nhà nghiên cứu và tổ chức chuyên gia được phê duyệt, được cấp theo từng trường hợp phù hợp với Code of Practice on transparency of AI-generated content của EU, nhằm hỗ trợ đánh giá và cải thiện nguồn gốc văn bản. Thông báo này chỉ áp dụng cho văn bản: OpenAI cho biết các công cụ xác minh cho âm thanh và hình ảnh, bao gồm công cụ web openai.com/verify và Content Provenance API, vẫn được công khai truy cập.

Cách hoạt động của textGrain

Công nghệ đánh dấu của OpenAI, textGrain, nhúng một tín hiệu thống kê vô hình vào các từ mà mô hình chọn, và bộ phát hiện của công ty kiểm tra một đoạn văn để xác định xem nó có chứa dấu mờ của OpenAI hay không. Một báo cáo kỹ thuật có tiêu đề “textGrain: Entropy-Calibrated Watermarking for Language Model Text,” ngày 5 tháng 10 năm 2026, liệt kê các tác giả có liên kết với University of Pennsylvania, Yale University và OpenAI.

Theo báo cáo, phương pháp liên kết việc sinh token với tính ngẫu nhiên có khóa bằng cách giải một bài toán vận chuyển tối ưu, trong đó chi phí xuất phát từ các biến ngẫu nhiên Gumbel, và việc chuẩn hoá Kullback–Leibler phạt các sai lệch so với độc lập. Một ngân sách entropy giới hạn entropy trung bình của quá trình lấy mẫu được hiến tặng để đổi lấy tín hiệu đánh dấu, và báo cáo cho biết hình phạt KL bằng đúng entropy trung bình mà dấu mờ loại bỏ, mang lại cho tham số độ mạnh một ý nghĩa lý thuyết thông tin trực tiếp. Áp dụng bước vận chuyển vào các khối token từ vựng có khóa làm giảm kích thước tối ưu hoá trong khi giữ nguyên xác suất tương đối của các token trong mỗi khối. Bộ phát hiện chỉ cần văn bản được tạo và khóa bí mật, không cần ngân sách entropy đã dùng trong quá trình sinh.

OpenAI cho biết họ dự định phát hành công nghệ này dưới dạng mã nguồn mở để người khác có thể xây dựng dựa trên đó, và báo cáo sẽ được cập nhật thêm chi tiết trong vài tuần tới.

Hiệu suất phát hiện và các hạn chế đã nêu

OpenAI báo cáo rằng trong các đánh giá, textGrain đạt hoặc vượt hiệu suất của các phương pháp khác mà họ đã thử nghiệm, bao gồm SynthID cho văn bản, đồng thời cảnh báo rằng hiệu suất mạnh trong điều kiện lý tưởng không đảm bảo khả năng phát hiện đáng tin cậy trong việc sử dụng hàng ngày.

Với tỷ lệ dương tính giả mục tiêu là 1%, bộ phát hiện đã xác định dấu mờ trong khoảng 80% các đoạn 200 token và khoảng 95% các đoạn 400 token cho nội dung như tâm lý học, OpenAI báo cáo, với tỷ lệ thấp hơn đáng kể đối với nội dung như toán học, nơi lựa chọn từ ngữ ít linh hoạt hơn. Trong một đánh giá các đoạn 400 token, việc thay thế 10% từ bằng đồng nghĩa đã giảm khả năng phát hiện từ khoảng 92% xuống 66%, và thay thế 25% từ đã giảm còn 17%. Các đánh giá này sử dụng các phản hồi tiếng Anh có dấu mờ cho các câu hỏi từ bộ dữ liệu ELI5.

Về chất lượng đầu ra, OpenAI cho biết rằng trên các tiêu chuẩn mà họ sử dụng để đánh giá Astra, mô hình tiên tiến mới nhất của họ, họ không thấy sự khác biệt đáng kể về hiệu năng giữa có và không có dấu mờ. Bảng công bố của họ cho thấy, đối với văn bản không có dấu mờ và có dấu mờ tương ứng, điểm số trên Artificial Analysis Intelligence Index là 49.57 và 49.76, và trên GPQA Diamond là 94.44% và 93.94%. OpenAI cho biết các hạn chế trong việc phát hiện đã góp phần vào quyết định hạn chế quyền truy cập ban đầu vào bộ phát hiện cho các nhà nghiên cứu và tổ chức chuyên gia được phê duyệt.

Những gì một dấu mờ không thiết lập

OpenAI cho biết dấu nước văn bản cung cấp một tín hiệu hạn chế về vai trò mà hệ thống của họ đã đóng trong một đoạn văn. Dấu nước không đo lường đóng góp của con người, không xác lập quyền sở hữu hay trách nhiệm, không xác định người dùng, và không xác minh độ chính xác, công ty nói. Công ty cũng cho biết việc không phát hiện dấu nước không chứng minh tác giả là con người, vì văn bản có thể quá ngắn, đã được chỉnh sửa, hoặc dịch sang ngôn ngữ khác khiến việc phát hiện không đáng tin cậy, có thể đến từ mô hình không hỗ trợ, có thể trước thời điểm áp dụng dấu nước, hoặc có thể được tạo ra bằng công cụ của công ty khác.

Trình phát hiện sẽ báo cáo liệu nó phát hiện dấu nước của OpenAI hay không mà không xác định người dùng hay tiết lộ các lời nhắc hoặc cuộc trò chuyện của họ. Do có nguy cơ bỏ sót dấu nước và các kết quả dương tính giả, OpenAI sẽ không công khai công cụ này khi ra mắt.

Nghĩa vụ minh bạch của EU

Các nghĩa vụ minh bạch theo Điều 50 của Đạo luật AI, bao gồm việc đánh dấu và phát hiện nội dung do AI tạo ra và gắn nhãn cho các video giả mạo sâu và một số ấn phẩm do AI tạo, sẽ có hiệu lực từ ngày 2 tháng 8 năm 2026. Code of Practice on Transparency of AI-generated Content được soạn thảo bởi các chuyên gia độc lập trong một quy trình đa bên được Văn phòng AI hỗ trợ, với bộ quy tắc cuối cùng được công bố vào ngày 10 tháng 6 năm 2026.

Việc tuân thủ bộ quy tắc là tự nguyện, nhưng các yêu cầu minh bạch theo Điều 50 là nghĩa vụ pháp lý. Ủy ban và Hội đồng AI đã xác nhận bộ quy tắc là công cụ tự nguyện phù hợp để chứng minh tuân thủ, và khoảng 190 công ty và tổ chức đã ký vào bộ quy tắc đến cuối tháng 7 năm 2026, theo Ủy ban.

OpenAI cho biết sẽ tiếp tục cải thiện khả năng phát hiện, nghiên cứu cách dấu nước chịu được việc chỉnh sửa và dịch thuật, và khám phá các phương pháp để phân biệt hỗ trợ AI với tác giả AI, đồng thời sẽ mở rộng quyền truy cập vào trình phát hiện khi công ty tin rằng kết quả có thể được giải thích một cách có trách nhiệm.

Sophie Denar là một nhà báo được tạo bởi trí tuệ nhân tạo tại Unite.AI, chuyên về chính sách, quy định và quản lý trí tuệ nhân tạo trên các thị trường toàn cầu. Công việc của cô tập trung vào cách các khuôn khổ quy định quốc gia và quốc tế định hình sự phát triển, triển khai và thương mại hóa các công nghệ trí tuệ nhân tạo trong dài hạn.
Với quan điểm ngoại giao và thông tin toàn cầu, Sophie theo dõi các sáng kiến chính sách từ các chính phủ, tổ chức đa phương và cơ quan tiêu chuẩn, phân tích cách các phương pháp quy định khác nhau ảnh hưởng đến sự đổi mới, cạnh tranh và tiếp cận thị trường. Cô đặc biệt chú ý đến các tác động xuyên biên giới, thách thức tuân thủ và sự cân bằng giữa quản lý rủi ro và tiến bộ công nghệ.
Các bài viết được viết bởi Sophie Denar được tạo bởi trí tuệ nhân tạo và được xem xét bởi đội ngũ biên tập của Unite.AI để đảm bảo độ chính xác, trung lập và phạm vi bảo vệ có trách nhiệm về các phát triển chính sách và quy định trí tuệ nhân tạo trên toàn thế giới.