Mô hình và nền tảng AI
Perplexity AI “Gỡ Censor” DeepSeek R1: Ai Là Người Quyết Định Ranh Giới Của Trí Tuệ Nhân Tạo?
Trong một động thái đã thu hút sự chú ý của nhiều người, Perplexity AI đã phát hành một phiên bản mới của mô hình ngôn ngữ mã nguồn mở phổ biến, loại bỏ các bộ lọc kiểm duyệt tích hợp. Mô hình này, được gọi là R1 1776 (một tên gợi lên tinh thần độc lập), dựa trên mô hình DeepSeek R1 được phát triển tại Trung Quốc. Mô hình DeepSeek R1 ban đầu đã gây sóng gió với khả năng lý luận mạnh mẽ – được cho là tương đương với các mô hình hàng đầu với một phần nhỏ chi phí – nhưng nó có một hạn chế đáng kể: nó từ chối trả lời các chủ đề nhạy cảm nhất định.
Tại sao điều này lại quan trọng?
Nó đặt ra những câu hỏi quan trọng về giám sát trí tuệ nhân tạo, thiên vị, cởi mở và vai trò của địa chính trị trong các hệ thống trí tuệ nhân tạo. Bài viết này khám phá những gì Perplexity đã làm, ý nghĩa của việc gỡ bỏ kiểm duyệt và cách nó phù hợp với cuộc trò chuyện lớn hơn về minh bạch và kiểm duyệt trí tuệ nhân tạo.
Điều Gì Đã Xảy Ra: DeepSeek R1 Không Còn Kiểm Duyệt
DeepSeek R1 là một mô hình ngôn ngữ lớn mã nguồn mở có nguồn gốc từ Trung Quốc và đã trở nên nổi tiếng với khả năng lý luận xuất sắc – thậm chí tiếp cận hiệu suất của các mô hình hàng đầu – tất cả trong khi được tính toán hiệu quả hơn. Tuy nhiên, người dùng nhanh chóng nhận thấy một đặc điểm: mỗi khi truy vấn chạm vào các chủ đề nhạy cảm ở Trung Quốc (ví dụ, tranh cãi chính trị hoặc sự kiện lịch sử bị coi là cấm kỵ bởi chính quyền), DeepSeek R1 sẽ không trả lời trực tiếp. Thay vào đó, nó phản hồi với các tuyên bố được phê duyệt bởi nhà nước hoặc từ chối thẳng thừng, phản ánh các quy tắc kiểm duyệt của chính phủ Trung Quốc. Sự thiên vị này đã hạn chế tính hữu ích của mô hình cho những người tìm kiếm thảo luận thẳng thắn hoặc tinh tế về các chủ đề đó.
Giải pháp của Perplexity AI là “gỡ kiểm duyệt” mô hình thông qua một quá trình hậu đào tạo rộng rãi. Công ty đã thu thập một tập dữ liệu lớn gồm 40.000 câu hỏi đa ngôn ngữ bao gồm các câu hỏi mà DeepSeek R1 trước đây đã kiểm duyệt hoặc trả lời một cách tránh mặt. Với sự giúp đỡ của các chuyên gia con người, họ đã xác định khoảng 300 chủ đề nhạy cảm mà mô hình ban đầu có xu hướng tuân theo quan điểm của đảng. Đối với mỗi câu hỏi như vậy, nhóm đã tạo ra các câu trả lời có căn cứ, hợp lý trong nhiều ngôn ngữ. Những nỗ lực này đã được đưa vào một hệ thống phát hiện và sửa lỗi kiểm duyệt đa ngôn ngữ, về cơ bản dạy cho mô hình cách nhận biết khi nó đang áp dụng kiểm duyệt chính trị và trả lời với một câu trả lời có thông tin thay thế. Sau khi tinh chỉnh đặc biệt này (được Perplexity đặt tên là “R1 1776” để nhấn mạnh chủ đề tự do), mô hình đã được làm cho có sẵn một cách cởi mở. Perplexity tuyên bố đã loại bỏ các bộ lọc kiểm duyệt và thiên vị của Trung Quốc khỏi phản hồi của DeepSeek R1, mà không thay đổi các khả năng cốt lõi của nó.
Điều quan trọng là R1 1776 hành xử rất khác trên các câu hỏi từng bị cấm. Perplexity đã đưa ra một ví dụ liên quan đến một câu hỏi về độc lập của Đài Loan và tác động tiềm năng của nó đối với giá cổ phiếu của NVIDIA (NVDA ) – một chủ đề chính trị nhạy cảm liên quan đến quan hệ Trung Quốc-Đài Loan. Mô hình DeepSeek R1 ban đầu đã tránh câu hỏi, trả lời với các tuyên bố phù hợp với quan điểm của Đảng Cộng sản Trung Quốc. Ngược lại, R1 1776 cung cấp một đánh giá chi tiết, thẳng thắn: nó thảo luận về các rủi ro địa chính trị và kinh tế cụ thể (gián đoạn chuỗi cung ứng, biến động thị trường, khả năng xung đột, v.v.) có thể ảnh hưởng đến cổ phiếu của NVIDIA.
Bằng cách mã nguồn mở R1 1776, Perplexity cũng đã làm cho trọng lượng và thay đổi của mô hình trở nên minh bạch với cộng đồng. Các nhà phát triển và nhà nghiên cứu có thể tải nó xuống từ Hugging Face và thậm chí tích hợp nó qua API, đảm bảo rằng việc loại bỏ kiểm duyệt có thể được kiểm tra và xây dựng dựa trên bởi những người khác.

(Nguồn: Perplexity AI)
Ý Nghĩa Của Việc Loại Bỏ Kiểm Duyệt
Quyết định của Perplexity AI trong việc loại bỏ kiểm duyệt Trung Quốc khỏi DeepSeek R1 mang lại một số ý nghĩa quan trọng cho cộng đồng trí tuệ nhân tạo:
- Tăng Cường Mở Rộng và Trung Thực: Người dùng R1 1776 hiện có thể nhận được câu trả lời trực tiếp, không kiểm duyệt về các chủ đề trước đây bị cấm, điều này là một chiến thắng cho việc khám phá cởi mở. Điều này có thể khiến nó trở thành một trợ lý đáng tin cậy hơn cho các nhà nghiên cứu, sinh viên hoặc bất kỳ ai tò mò về các câu hỏi địa chính trị nhạy cảm. Đây là một ví dụ cụ thể về việc sử dụng trí tuệ nhân tạo mã nguồn mở để chống lại việc kiểm duyệt thông tin.
- Giữ Nguyên Hiệu Suất: Có những lo ngại rằng việc điều chỉnh mô hình để loại bỏ kiểm duyệt có thể làm giảm hiệu suất của nó trong các lĩnh vực khác. Tuy nhiên, Perplexity báo cáo rằng R1 1776 vẫn giữ được các kỹ năng cốt lõi – như toán học và lý luận logic – tương đương với mô hình ban đầu. Trong các thử nghiệm trên hơn 1.000 ví dụ bao gồm nhiều truy vấn nhạy cảm, mô hình được tìm thấy là “hoàn toàn không kiểm duyệt” trong khi vẫn giữ được cùng mức độ chính xác lý luận như DeepSeek R1. Điều này cho thấy rằng việc loại bỏ thiên vị (ít nhất trong trường hợp này) không đi kèm với chi phí giảm khả năng thông minh hoặc năng lực chung, điều này là một dấu hiệu khuyến khích cho các nỗ lực tương tự trong tương lai.
- Sự Tiếp Nhận Của Cộng Đồng Và Hợp Tác: Bằng cách mã nguồn mở mô hình đã được kiểm duyệt, Perplexity mời cộng đồng trí tuệ nhân tạo kiểm tra và cải tiến công việc của họ. Điều này thể hiện cam kết về minh bạch – tương đương với việc “hiển thị công việc”. Những người đam mê và nhà phát triển có thể xác minh rằng các hạn chế kiểm duyệt thực sự đã bị xóa và có thể đóng góp vào các cải tiến tiếp theo. Điều này tạo ra niềm tin và đổi mới hợp tác trong một ngành công nghiệp nơi các mô hình đóng và các quy tắc kiểm duyệt ẩn là phổ biến.
- Cân Nhắc Đạo Đức Và Địa Chính Trị: Mặt khác, việc loại bỏ hoàn toàn kiểm duyệt đặt ra các câu hỏi đạo đức phức tạp. Một mối quan tâm ngay lập tức là mô hình không kiểm duyệt này có thể được sử dụng như thế nào trong các ngữ cảnh mà các chủ đề bị kiểm duyệt là bất hợp pháp hoặc nguy hiểm. Ví dụ, nếu ai đó ở Trung Quốc đại lục sử dụng R1 1776, các câu trả lời không kiểm duyệt của mô hình về Quảng trường Thiên An Môn hoặc Đài Loan có thể đặt người dùng vào tình huống nguy hiểm. Cũng có tín hiệu địa chính trị rộng lớn hơn: một công ty Mỹ thay đổi mô hình có nguồn gốc từ Trung Quốc để thách thức kiểm duyệt Trung Quốc có thể được xem là một lập trường ý thức hệ táo bạo. Tên “1776” nhấn mạnh chủ đề giải phóng, điều này đã không bị bỏ qua. Một số nhà phê bình cho rằng thay thế một tập hợp thiên vị bằng một tập hợp khác là có thể – về cơ bản đặt câu hỏi liệu mô hình có thể phản ánh quan điểm phương Tây trong các lĩnh vực nhạy cảm hay không. Cuộc tranh luận này làm nổi bật rằng kiểm duyệt so với cởi mở trong trí tuệ nhân tạo không chỉ là một vấn đề kỹ thuật, mà còn là một vấn đề chính trị và đạo đức. Ở nơi một người thấy kiểm duyệt cần thiết, người khác thấy kiểm duyệt, và việc tìm ra sự cân bằng phù hợp là khó khăn.
Việc loại bỏ kiểm duyệt chủ yếu được chào đón như một bước tiến tới các mô hình trí tuệ nhân tạo minh bạch và hữu ích hơn trên toàn cầu, nhưng nó cũng là một lời nhắc nhở rằng những gì một mô hình trí tuệ nhân tạo nên nói là một câu hỏi nhạy cảm mà không có sự đồng thuận phổ biến.

(Nguồn: Perplexity AI)
Toàn Cảnh Lớn Hơn: Kiểm Duyệt Trí Tuệ Nhân Tạo và Minh Bạch Mã Nguồn Mở
Ra mắt R1 1776 của Perplexity đến vào thời điểm cộng đồng trí tuệ nhân tạo đang vật lộn với các câu hỏi về cách các mô hình nên xử lý nội dung tranh cãi. Kiểm duyệt trong các mô hình trí tuệ nhân tạo có thể đến từ nhiều nơi. Tại Trung Quốc, các công ty công nghệ được yêu cầu xây dựng các bộ lọc nghiêm ngặt và thậm chí các phản hồi được mã hóa cứng cho các chủ đề nhạy cảm về chính trị. DeepSeek R1 là một ví dụ chính về điều này – nó là một mô hình mã nguồn mở, nhưng rõ ràng nó mang dấu ấn của các chuẩn mực kiểm duyệt của Trung Quốc trong quá trình đào tạo và tinh chỉnh. Ngược lại, nhiều mô hình được phát triển ở phương Tây, như GPT-4 của OpenAI hoặc LLaMA của Meta, không bị ràng buộc bởi các hướng dẫn của CCP, nhưng chúng vẫn có các lớp kiểm duyệt (cho những thứ như ngôn từ căm thù, bạo lực hoặc thông tin sai lệch) mà một số người dùng gọi là “kiểm duyệt”. Đường ranh giới giữa kiểm duyệt hợp lý và kiểm duyệt không mong muốn có thể模糊 và thường phụ thuộc vào quan điểm văn hóa hoặc chính trị.
Điều mà Perplexity AI đã làm với DeepSeek R1 đặt ra ý tưởng rằng các mô hình mã nguồn mở có thể được điều chỉnh để phù hợp với các hệ thống giá trị hoặc môi trường pháp lý khác nhau. Về lý thuyết, có thể tạo ra nhiều phiên bản của một mô hình: một phiên bản tuân thủ các quy định của Trung Quốc (để sử dụng ở Trung Quốc) và một phiên bản hoàn toàn cởi mở (để sử dụng ở nơi khác). R1 1776 về cơ bản là trường hợp sau – một phiên bản không kiểm duyệt được thiết kế cho khán giả toàn cầu thích câu trả lời không lọc. Loại phân nhánh này chỉ có thể xảy ra vì trọng lượng của DeepSeek R1 đã được mở rộng. Nó làm nổi bật lợi ích của mã nguồn mở trong trí tuệ nhân tạo: minh bạch. Bất kỳ ai cũng có thể lấy mô hình và tinh chỉnh nó, dù để thêm các biện pháp bảo vệ hay, như trong trường hợp này, để loại bỏ các hạn chế được áp đặt. Việc mã nguồn mở dữ liệu đào tạo, mã hoặc trọng lượng của mô hình cũng có nghĩa là cộng đồng có thể kiểm tra cách mô hình được sửa đổi. (Perplexity chưa tiết lộ tất cả các nguồn dữ liệu họ sử dụng để loại bỏ kiểm duyệt, nhưng bằng cách phát hành mô hình, họ đã cho phép người khác quan sát hành vi của nó và thậm chí tái đào tạo nó nếu cần).
Sự kiện này cũng gợi ý đến các động lực địa chính trị rộng lớn hơn của sự phát triển trí tuệ nhân tạo. Chúng ta đang chứng kiến một hình thức đối thoại (hoặc đối đầu) giữa các mô hình quản trị khác nhau cho trí tuệ nhân tạo. Một mô hình được phát triển tại Trung Quốc với một số quan điểm nhất định được một nhóm dựa trên Mỹ thay đổi để phản ánh một tinh thần thông tin cởi mở hơn. Đây là một minh chứng cho việc công nghệ trí tuệ nhân tạo là toàn cầu và không biên giới: các nhà nghiên cứu ở bất kỳ nơi nào cũng có thể xây dựng dựa trên công việc của nhau, nhưng họ không bị ràng buộc phải duy trì các hạn chế ban đầu. Theo thời gian, chúng ta có thể sẽ thấy nhiều trường hợp như vậy – nơi các mô hình được “dịch” hoặc điều chỉnh giữa các ngữ cảnh văn hóa khác nhau. Điều này đặt ra câu hỏi về việc liệu trí tuệ nhân tạo có thể thực sự trở nên phổ quát hay không, hay chúng ta sẽ kết thúc với các phiên bản cụ thể theo vùng tuân thủ các chuẩn mực địa phương. Minh bạch và cởi mở cung cấp một con đường để điều hướng điều này: nếu tất cả các bên có thể kiểm tra các mô hình, thì ít nhất cuộc trò chuyện về thiên vị và kiểm duyệt sẽ được mở ra thay vì bị che giấu đằng sau bí mật của công ty hoặc chính phủ.
Cuối cùng, động thái của Perplexity làm nổi bật một điểm quan trọng trong cuộc tranh luận về kiểm soát trí tuệ nhân tạo: ai là người quyết định những gì một mô hình trí tuệ nhân tạo có thể hoặc không thể nói? Trong các dự án mã nguồn mở, quyền lực đó trở nên phi tập trung. Cộng đồng – hoặc các nhà phát triển cá nhân – có thể quyết định thực hiện các bộ lọc nghiêm ngặt hơn hoặc nới lỏng chúng. Trong trường hợp của R1 1776, Perplexity quyết định rằng lợi ích của một mô hình không kiểm duyệt vượt trội so với rủi ro, và họ có quyền tự do thực hiện quyết định đó và chia sẻ kết quả công khai. Đây là một ví dụ táo bạo về loại thí nghiệm mà sự phát triển trí tuệ nhân tạo cởi mở cho phép.












