Quy định
USA TODAY kiện OpenAI vì nội dung tin tức có bản quyền trong việc đào tạo AI

USA TODAY Co., Inc. và các thực thể báo chí liên kết của mình đã kiện OpenAI tại tòa án liên bang ở New York vào ngày 8 tháng 10 năm 2026, cáo buộc công ty đã đào tạo các mô hình GPT của mình trên hàng trăm ngàn bài báo có bản quyền của họ mà không có sự cho phép và tái đóng gói báo chí của họ trong các đầu ra chatbot thay thế cho bản gốc. Vụ kiện yêu cầu bồi thường hơn 250 triệu đô la.
Bản Đệ Trình và Yêu Cầu Bồi Thường
Vụ án, USA Today Co., Inc. v. OpenAI Foundation, đã được nộp tại Tòa án Liên bang khu vực Nam New York bởi luật sư Steven Lieberman của Rothwell, Figg, Ernst & Manbeck. Đơn đơn kiện đã được ghi nhận vào ngày 8 tháng 10 năm 2026, kèm theo một bản phụ lục đăng ký bản quyền và một bản phụ lục thứ hai chứa các ví dụ đầu ra GPT-5.6, theo hồ sơ tòa án. Các mục nhập hồ sơ trong cùng ngày bao gồm một tờ bìa dân sự, một mẫu thông báo bản quyền, một thông báo xuất hiện, và một yêu cầu phát hành trát.
Một tuyên bố về tính liên quan được nộp cùng ngày yêu cầu vụ việc được xem là liên quan đến vụ kiện vi phạm bản quyền của OpenAI đã đang chờ xử lý tại tòa án này. Đơn kiện cho biết các nguyên đơn gia nhập một danh sách dài các chủ sở hữu bản quyền đã kiện OpenAI và các công ty AI khác, nhiều vụ trong số đó đã được hợp nhất tại tòa án này.
Theo khung pháp lý mà đơn kiện trích dẫn, các nguyên đơn có thể thu hồi tới 150.000 USD cho mỗi hành vi vi phạm bản quyền cố ý, cộng thêm tới 25.000 USD cho mỗi vi phạm liên quan đến việc loại bỏ thông tin quản lý bản quyền, dữ liệu sở hữu và quyền kèm theo các tác phẩm đã xuất bản. Các nguyên đơn cáo buộc các mô hình của OpenAI đã sao chép hàng trăm ngàn bài báo và các tài liệu khác từ các ấn phẩm của họ.
Các cáo buộc về dữ liệu đào tạo và sao chép
Theo đơn kiện, các mô hình ngôn ngữ lớn của OpenAI đã được đào tạo trên tài liệu có bản quyền được thu thập từ internet mà không có sự cho phép, bất kể các rào cản trả phí hay các hạn chế truy cập khác, và OpenAI đã sử dụng các chương trình được thiết kế để loại bỏ thông tin quản lý bản quyền cho biết các tác phẩm được bảo vệ. Đơn kiện cũng trích dẫn bằng chứng bằng văn bản mà OpenAI đã gửi cho cuộc điều tra của Hạ viện Anh vào tháng 12 năm 2023, trong đó công ty cho biết vì bản quyền bao phủ gần như mọi dạng biểu đạt của con người, việc giới hạn dữ liệu đào tạo chỉ ở các tác phẩm thuộc phạm vi công cộng sẽ không tạo ra các hệ thống AI đáp ứng nhu cầu hiện tại.
Đơn kiện cho biết nội dung từ các ấn phẩm của nguyên đơn bao gồm hơn 160.000 mục trong WebText, bộ dữ liệu nội bộ mà OpenAI xây dựng để đào tạo GPT-2, trong đó có 83.266 mục từ usatoday.com và 12.994 mục từ freep.com. Đơn cũng nêu rằng các miền của các ấn phẩm chiếm hơn 122 triệu token trong C4, một tập hợp con tiếng Anh đã được lọc từ bản sao chụp năm 2019 của kho lưu trữ Common Crawl, và tái tạo hỗn hợp đào tạo GPT-3 do OpenAI công bố, trong đó Common Crawl chiếm 60% và WebText2, phiên bản mở rộng của bộ dữ liệu WebText, chiếm 22%.
Để lập luận rằng OpenAI hiểu những gì mô hình của mình chứa đựng, đơn kiện trích dẫn các cuộc trao đổi nội bộ. Nó cho biết đồng sáng lập Greg Brockman đã nói với đồng nghiệp rằng các mô hình đặc biệt giỏi trong việc dự đoán văn bản của các bài báo tin tức, và một bài thuyết trình năm 2020 của lãnh đạo nghiên cứu thời đó Dario Amodei đã liệt kê việc tạo tin tức là một trong những kỹ năng của GPT-3. Nó trích dẫn Phó Chủ tịch Nghiên cứu của OpenAI phát biểu, “Chúng tôi đào tạo các mạng của mình để ghi nhớ dữ liệu đào tạo — đó là mục tiêu của chúng,” và dẫn các tin nhắn nội bộ tháng 6 năm 2022 trong đó nhân viên thừa nhận rằng GPT-4 sẽ ghi nhớ một lượng lớn dữ liệu và sẽ rất hiệu quả trong việc tái tạo chúng.
Đơn kiện còn cáo buộc rằng trong vòng ba năm, Microsoft đã cung cấp cho OpenAI một bản sao của Bing Index, một bộ sưu tập hàng tỷ trang web được thu thập cho công cụ tìm kiếm của Microsoft và bao gồm nội dung của các nguyên đơn, dưới sáng kiến có mã tên là Project Taxi, và Microsoft cũng đã phát triển và vận hành một trình thu thập dữ liệu gọi là Project Mango thay mặt cho OpenAI, với chi phí mà OpenAI đã trả cho Microsoft. Đơn cũng cáo buộc rằng các bộ lọc đầu ra của OpenAI không loại bỏ nội dung từ bất kỳ thực thể nào chưa kiện công ty, một cách tiếp cận mà một giám đốc điều hành Microsoft mô tả nội bộ là một sự che giấu tình cờ.
Ví dụ đầu ra GPT-5.6
Bản khai tái hiện các ví dụ trong đó GPT-5.6, khi được yêu cầu tìm và tóm tắt một bài báo cụ thể theo tiêu đề, đã tạo ra những bản tóm tắt đa phần đoạn dài mà khiếu kiện cáo mô tả là những bản tóm tắt đa phần đoạn, được diễn đạt lại các bài gốc và tuân theo cấu trúc tổ chức của chúng. Các ví dụ tái hiện bao gồm các bài báo từ Indianapolis Star, Detroit Free Press, Knoxville News-Sentinel, Palm Beach Post, Tennessean, Enquirer, Des Moines Register, Courier-Journal, Naples Daily News, Asbury Park Press, Milwaukee Journal Sentinel, Columbus Dispatch, Oklahoman và Star News, với các phiên bản đầy đủ được đính kèm dưới dạng tài liệu minh chứng.
Đơn kiện cáo buộc OpenAI đã chủ động huấn luyện lại các mô hình của mình để tóm tắt các bài báo có bản quyền thay vì trả lại nguyên văn các bài báo, tạo ra các bản thay thế có cùng mục đích cung cấp thông tin như bản gốc. Nó trích dẫn Giám đốc ChatGPT của OpenAI thừa nhận rằng một khi ChatGPT đưa ra câu trả lời, không có “lý do tốt nào để nhấp” vào liên kết tới nguồn gốc, và dẫn lời một kỹ sư của OpenAI cho rằng dù liên kết được hiển thị nổi bật đến đâu, người dùng vẫn sẽ không nhấp. Khi các đầu ra của OpenAI sao chép hoặc đóng gói lại nội dung của họ, nguyên đơn cáo buộc, người dùng không có lý do nào để truy cập các nguồn gốc gốc hoặc trả phí thuê bao.
Các Bên
Nguyên đơn, tất cả đều thuộc sở hữu của USA TODAY Co., Inc., nắm giữ bản quyền nội dung được xuất bản bởi 19 tờ báo, bao gồm USA TODAY, The Tennessean, Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, Democrat & Chronicle, The Knoxville News‑Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier‑Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post và Star News. Đơn kiện mô tả USA TODAY Co., trước đây là Gannett Co., Inc., là một công ty truyền thông đa dạng có lịch sử từ năm 1906, xuất bản USA TODAY và hàng trăm ấn phẩm hàng ngày, và cho biết các ấn phẩm của họ đã giành được hàng chục giải Pulitzer và tuyển dụng hàng trăm nhà báo trên mười ba tiểu bang.
Các bị đơn là OpenAI Foundation; OpenAI GP, LLC; OAI International, Inc.; OpenAI OpCo, LLC; OpenAI Global, LLC; OAI Corporation; và OpenAI Group PBC, mỗi bên được mô tả trong đơn kiện là một thực thể có trụ sở tại San Francisco, đã tham gia trực tiếp hoặc thu lợi từ vi phạm được cáo buộc. Đơn kiện kể lại việc tái vốn của OpenAI vào ngày 28 tháng 10 năm 2025, theo đó tổ chức phi lợi nhuận trở thành OpenAI Foundation, nắm giữ cổ phần trong công ty vì lợi nhuận mà OpenAI mô tả có giá trị khoảng 130 tỷ đô la, và công ty vì lợi nhuận trở thành OpenAI Group PBC, một công ty trách nhiệm công cộng. Dựa trên các tiết lộ của OpenAI, đơn kiện cho biết ChatGPT có hơn 900 triệu người dùng hoạt động hàng tuần và hơn 50 triệu thuê bao trả phí tính đến tháng 3 năm 2026.
Các mô hình liên quan bao gồm từ GPT-1 đến GPT-6.1 và GPT-OSS, bao gồm tất cả các biến thể Instant, Thinking, mini, nano và Pro, theo đơn kiện. Nguyên đơn yêu cầu xét xử bởi bồi thẩm đoàn.












