Mô hình và nền tảng AI
Alibaba tuyên bố Qwen3.8 chỉ thua Anthropic’s Fable 5

Alibaba đã giới thiệu mô hình mạnh nhất trong dòng Qwen và cho biết nó đứng thứ hai trong số các hệ thống tiền phong trên thế giới, chỉ sau Claude Fable 5 của Anthropic. Tuy nhiên, tuyên bố này không đi kèm với những thứ cần thiết để kiểm chứng: không có điểm chuẩn, không có thẻ mô hình, và không có đánh giá độc lập.
Mô hình này, một bản xem trước có tên Qwen3.8-Max-Preview, đã được phát hành trên tài khoản của nhóm Qwen trong một bài đăng trên X trong Hội nghị Trí tuệ Nhân tạo Thế giới tại Thượng Hải vào ngày 19 tháng 7 năm 2026, được mô tả là “chỉ sau Fable 5” và tương đương với các hệ thống tiền phong hàng đầu. Nó có 2,4 nghìn tỷ tham số và là mô hình Qwen đầu tiên vượt qua mốc một nghìn tỷ tham số để xử lý hình ảnh, video và tài liệu, không chỉ là văn bản — một bước chuyển giúp Qwen từ một công cụ văn bản trở thành một hệ thống đa năng mà các đối thủ Mỹ đã phát hành.
Bản xem trước này hiện có sẵn thông qua kế hoạch đăng ký Token của Alibaba và các công cụ phát triển Qoder và QoderWork với giá 10% so với giá tiêu chuẩn trong thời gian thử nghiệm, với trọng lượng mở được hứa hẹn nhưng không có ngày phát hành hoặc điều khoản cấp phép được tiết lộ.
Xếp hạng không có bảng điểm
Số lượng tham số mô tả kích thước của mô hình, không phải kỹ năng của nó. Một con số 2,4 nghìn tỷ tham số không nói lên gì về cách Qwen3.8 lý luận, lập kế hoạch hoặc thực hiện trên công việc thực tế — đó là những gì các điểm chuẩn và đánh giá được sử dụng, và chính xác là những gì Alibaba đã bỏ qua.
Công ty này không xuất bản thẻ mô hình, không có số lượng tham số hoạt động trên mỗi truy vấn, và không có kết quả cấp nhiệm vụ, thậm chí không chống lại mô hình hàng đầu trước đó của mình. Nó chỉ mô tả Qwen3.8-Max là “tiếp tục phát triển.” Mỗi một trong những khoảng trống đó đều quan trọng đối với người mua: số lượng tham số hoạt động cho thấy lượng tính toán mà một truy vấn tiêu thụ, thẻ mô hình ghi lại dữ liệu đào tạo và kiểm tra an toàn, và điểm số cấp nhiệm vụ cho thấy nơi mô hình mạnh và nơi nó không mạnh.
Điều đó trái ngược với cách Alibaba phát hành mô hình hàng đầu trước đó. Qwen3.7-Max đã được phát hành vào tháng 5 năm 2026 với một bộ số liệu đầy đủ, bao gồm cả điểm 56,6 trên Chỉ số Trí tuệ Nhân tạo Phân tích Độc lập Artificial Analysis Intelligence Index. Bảng điểm chuẩn của nhà cung cấp là một tuyên bố chứ không phải là một đo lường độc lập, nhưng ít nhất nó cung cấp cho các nhà đánh giá bên ngoài một số thứ để theo dõi — loại kiểm tra đã nhiều lần lật đổ các giả định về những gì các hệ thống này thực sự có thể làm. So sánh Fable 5 không cung cấp gì để kiểm chứng.
Hình ảnh độc lập hiện có cho thấy điều ngược lại. Không có bảng xếp hạng nào ngoài này đã xếp hạng Qwen3.8, và mô hình Qwen mới nhất được đánh giá, Qwen3.7-Max, đứng xa vị trí đầu của LMArena, bảng xếp hạng được bỏ phiếu bởi đám đông nơi Fable 5 hiện giữ vị trí đầu. Alibaba đang yêu cầu người mua chấp nhận một bước nhảy từ giữa nhóm đến vị trí thứ hai trên thế giới chỉ dựa trên lời nói của mình.
Cuộc đua tiền phong Trung Quốc
Thời điểm này không phải là trùng hợp. Moonshot AI đã ra mắt mô hình 2,8 nghìn tỷ tham số của mình, Kimi K3, ba ngày trước khi Alibaba xem trước, đưa các nhà phát triển Trung Quốc vào lớp đa nghìn tỷ tham số mà trước đây chỉ thuộc về các phòng thí nghiệm lớn nhất của Mỹ. Sự cạnh tranh một phần là nội bộ — Alibaba là một trong những nhà đầu tư của Moonshot, điều này khiến hai trong số các khoản đầu tư của mình cạnh tranh để trở thành mô hình mở mạnh nhất của Trung Quốc. Cả hai lần ra mắt đều dựa vào chiến lược trọng lượng mở mà các phòng thí nghiệm Mỹ hiện đang chạy đua để theo kịp.
Sự tương phản giữa hai lần ra mắt làm nổi bật vấn đề về bằng chứng. Kimi K3 đã được giao với sự kiểm tra của bên thứ ba: Artificial Analysis đã xếp hạng nó thứ ba trên chỉ số trí tuệ của mình, tương đương với Claude Opus 4.8 của Anthropic. Loại kiểm tra đó chính xác là những gì Qwen3.8 thiếu.
Các mô hình Trung Quốc đã giành được sự chấp nhận của các nhà phát triển phương Tây một phần vì chúng ít tốn kém để chạy so với các hệ thống hàng đầu của Mỹ, và các nhà lập pháp Mỹ đã bắt đầu cân nhắc cách hạn chế việc áp dụng chúng tại nhà. Đối với Alibaba, những gì đang diễn ra là sự cạnh tranh về mặt kỹ thuật cũng như cạnh tranh. Công ty đã dành cả năm qua để định vị Qwen như nhà cung cấp AI mặc định của Trung Quốc, giao một loạt các mô hình trọng lượng mở và xây dựng cơ sở hạ tầng đám mây và silicon tùy chỉnh của riêng mình để phục vụ chúng — một nỗ lực đã thu hút nhiều nhà phát triển đến với Qwen hơn bất kỳ gia đình mô hình Trung Quốc nào khác.
Chuyên gia phân tích của Bank of America (BAC ) do Alex Liu dẫn đầu đã viết rằng Kimi K3 đã nâng cao khả năng của các mô hình Trung Quốc và vị trí của Alibaba với tư cách là nhà lãnh đạo mã nguồn mở của đất nước có thể phải đối mặt với những thử thách mới. Các nhà đầu tư không bị ảnh hưởng: cổ phiếu của Alibaba đã tăng 5,4% vào ngày sau khi xem trước.
Xếp hạng cũng đã được truyền thông qua các kênh thân thiện. South China Morning Post, thuộc sở hữu của Alibaba, đã chuyển tiếp so sánh Fable 5 và mô tả của công ty về Qwen3.8 như một trong những mô hình mạnh nhất hiện có. Cho đến khi Alibaba xuất bản các điểm chuẩn hoặc trọng lượng mở như đã hứa, xếp hạng đó chỉ là một tuyên bố tiếp thị chứ không phải là kết quả đo lường — và hiện tại, chỉ những nhà phát triển trả mức giá xem trước giảm giá mới có thể kiểm tra nó.












