Model dan platform AI

Klaim Alibaba Qwen3.8 Hanya Kalah dengan Anthropic’s Fable 5

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Alibaba telah mempratinjau model paling kuat di lini Qwen dan mengatakan bahwa model ini menduduki peringkat kedua di antara sistem frontier dunia, hanya di bawah Anthropic’s Claude Fable 5. Klaim ini datang tanpa satu hal yang memungkinkan siapa pun untuk memeriksanya: tidak ada skor benchmark, tidak ada kartu model, dan tidak ada evaluasi independen.

Model ini, sebuah pratinjau yang disebut Qwen3.8-Max-Preview, diluncurkan di akun Qwen team dalam sebuah postingan di X selama Konferensi Artificial Intelligence Dunia di Shanghai pada 19 Juli 2026, digambarkan sebagai “hanya di bawah Fable 5” dan setara dengan sistem frontier terkemuka. Ini membawa 2,4 triliun parameter dan merupakan model Qwen pertama yang melebihi batas parameter triliun untuk menangani gambar, video, dan dokumen, bukan hanya teks — sebuah pergeseran yang memindahkan Qwen dari mesin teks ke sistem umum yang serupa dengan yang sudah digunakan oleh pesaing AS.

Pratinjau ini tersedia sekarang melalui langganan Rencana Token Alibaba dan alat pengembang Qoder dan QoderWork dengan tarif 10% dari tarif standar selama masa percobaan, dengan bobot terbuka yang dijanjikan tetapi tidak ada tanggal rilis atau ketentuan lisensi yang diungkapkan.

Peringkat tanpa skor

Jumlah parameter menggambarkan ukuran model, bukan keterampilannya. Angka 2,4 triliun parameter tidak mengatakan apa-apa tentang bagaimana Qwen3.8 beralasan, merencanakan, atau bertahan dalam pekerjaan nyata — itu adalah apa yang benchmark dan evaluasi untuk, dan itu adalah apa yang tepatnya Alibaba tinggalkan.

Perusahaan ini tidak menerbitkan kartu model, tidak ada hitungan berapa banyak parameter yang aktif pada setiap kueri, dan tidak ada hasil tingkat tugas, bahkan tidak melawan flagship sebelumnya. Ini hanya digambarkan sebagai “terus berkembang.” Setiap kesenjangan tersebut penting bagi pembeli: hitungan parameter yang diaktifkan menunjukkan berapa banyak komputasi yang dibakar oleh kueri, kartu model mendokumentasikan data pelatihan dan pengujian keamanan, dan skor tingkat tugas menunjukkan di mana model kuat dan di mana tidak.

Itu berbeda dari bagaimana Alibaba meluncurkan model teratas sebelumnya. Qwen3.7-Max tiba pada Mei 2026 dengan set lengkap angka yang dipublikasikan, termasuk skor 56,6 pada Indeks Intelijen Analisis Artificial. Tabel benchmark vendor sendiri adalah klaim daripada pengukuran independen, tetapi setidaknya memberikan evaluator luar sesuatu untuk dijalankan — jenis pemeriksaan yang telah menggagalkan asumsi tentang apa yang sistem ini dapat lakukan. Perbandingan Fable 5 tidak menawarkan apa-apa untuk diperiksa.

Gambaran independen yang ada menunjuk ke arah lain. Tidak ada papan peringkat luar yang telah menilai Qwen3.8, dan model Qwen terbaru yang dinilai, Qwen3.7-Max, berada jauh dari atas LMArena, papan peringkat yang dipilih oleh massa di mana Fable 5 saat ini memegang tempat pertama. Alibaba meminta pembeli untuk menerima lompatan dari tengah paket ke kedua di dunia dengan kata-katanya sendiri.

Balapan frontier Tiongkok

Waktu itu tidak kebetulan. Moonshot AI meluncurkan model 2,8 triliun parameter, Kimi K3, tiga hari sebelum pratinjau Alibaba, memindahkan pengembang Tiongkok ke kelas multi-triliun parameter yang sampai baru-baru ini dimiliki oleh laboratorium AS terbesar. Persaingan ini sebagian di dalam — Alibaba adalah salah satu pendukung Moonshot, yang meninggalkan dua taruhanannya sendiri untuk berebut gelar model terkuat Tiongkok. Kedua peluncuran juga bergantung pada strategi bobot terbuka yang laboratorium AS sekarang sedang berlomba untuk menyaingi.

Perbedaan antara dua rilis memperjelas poin tentang bukti. Kimi K3 diluncurkan dengan pemeriksaan pihak ketiga: Artificial Analysis menilainya ketiga pada indeks intelijennya, setara dengan Anthropic’s Claude Opus 4.8. Jenis pemeriksaan luar seperti itu adalah apa yang Qwen3.8 kurang.

Model Tiongkok telah mendapatkan pengakuan dari pengembang Barat sebagian karena biayanya lebih rendah untuk dijalankan daripada sistem AS teratas, dan legislator AS telah mulai mempertimbangkan bagaimana untuk mengurangi adopsi mereka di rumah. Bagi Alibaba, taruhan ini kompetitif serta teknis. Perusahaan ini telah menghabiskan setahun terakhir untuk memposisikan Qwen sebagai penyedia AI default Tiongkok, mengirimkan serangkaian model bobot terbuka dan membangun infrastruktur awan dan silikon khusus untuk melayani mereka — upaya yang telah menarik lebih banyak pengembang ke Qwen daripada hampir semua model Tiongkok lainnya.

Analisis Bank of America (BAC ) yang dipimpin oleh Alex Liu menulis bahwa Kimi K3 telah meningkatkan batas kemampuan model Tiongkok dan bahwa posisi Alibaba sebagai pemimpin sumber terbuka negara itu mungkin menghadapi tes segar. Investor tidak terganggu: saham Alibaba naik hingga 5,4% sehari setelah pratinjau.

Peringkat ini juga beredar melalui saluran ramah. South China Morning Post, yang dimiliki Alibaba, menyampaikan perbandingan Fable 5 dan deskripsi perusahaan tentang Qwen3.8 sebagai salah satu model paling kuat yang tersedia saat ini. Sampai Alibaba menerbitkan benchmark atau bobot terbuka yang dijanjikan, peringkat itu adalah garis pemasaran daripada hasil yang diukur — dan untuk sekarang, hanya pengembang yang membayar tarif pratinjau yang didiskon yang dapat mengujinya.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.