Model dan platform AI

Alibaba Merencanakan Model 5- hingga 10 Triliun Parameter dalam Dorongan AI Full-Stack

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

CEO Alibaba Group Eddie Wu mengatakan perusahaan berencana melatih model kecerdasan buatan baru dengan skala 5 hingga 10 triliun parameter, mempersembahkan sebuah peta jalan AI full-stack yang mencakup model, chip, dan infrastruktur cloud dalam pidato utama di Apsara Conference 2026 di Hangzhou pada 22 September 2026.

Apsara Conference adalah acara unggulan tahunan Alibaba Cloud. Agenda resmi konferensi menempatkan pidato Wu dalam Upacara Pembukaan dan Sesi Kunci Apsara, yang juga menampilkan sesi yang didedikasikan untuk Qwen dan pekerjaan silikon T-Head. Penyelenggara menggambarkan edisi 2026 mencakup tiga forum kunci utama, lebih dari 120 forum paralel, dan pameran teknologi seluas 50.000 meter persegi yang mempertemukan lebih dari 1.000 perusahaan.

Rencana untuk Model 5 hingga 10 Triliun Parameter

Wu mengatakan jalur teknis menuju superinteligensi buatan, atau ASI, semakin jelas, mengacu pada Recursive Self-Improvement, atau RSI, sebuah proses di mana model berinteraksi dengan tugas dunia nyata dan umpan balik, mengidentifikasi keterbatasan mereka sendiri, serta secara mandiri merancang eksperimen, mensintesis data, dan mengevaluasi hasil dalam siklus berkelanjutan evolusi diri. Ia menyatakan tim Qwen milik Alibaba sedang menjelajahi RSI dan telah membuat kemajuan berarti, sambil melanjutkan penelitian tentang arsitektur model dan optimisasi data.

Model yang direncanakan, dengan 5 hingga 10 triliun parameter, ditujukan untuk menyelesaikan tugas yang lebih kompleks dan berjangka panjang serta maju menuju ASI, kata Wu. Ia menyatakan bahwa model multimodal yang menyatukan pemahaman dan generasi merupakan arah riset inti lainnya, berargumen bahwa model memerlukan kemampuan multimodal yang mendalam untuk memahami dan mengkomunikasikan sinyal manusia seperti suara, visual, ekspresi wajah, dan gerakan, serta selaras dengan budaya, estetika, dan nilai-nilai manusia.

Wu menggambarkan tahun lalu sebagai periode di mana AI beralih dari artificial general intelligence sebagai titik awal menuju ASI yang beriterasi sendiri, dengan paradigma “vibe coding” berkembang menjadi “vibe working” spektrum penuh dan apa yang ia sebut sebagai terobosan keputusan dalam pelaksanaan tugas berjangka panjang. Ia mengemukakan dua pandangan tentang era ini: bahwa mesin akan menghasilkan lebih dari 1.000 kali pemikiran seluruh umat manusia secara gabungan, dan bahwa produk yang benar‑benar akan mendefinisikan era ini belum muncul. Pemikiran mesin saat ini hanya kurang dari 3 persen dari total pemikiran manusia, katanya, sementara daya mesin sudah menggerakkan 99,9 persen pekerjaan fisik dunia, dan ia memprediksi pemikiran mesin pada akhirnya akan menanggung 99,9 persen semua pemikiran.

Wu menyebut pemrograman AI “hanya lampu pijar era Kecerdasan Mesin,” berargumen bahwa sekadar mengotomatisasi pekerjaan manusia yang ada tidak akan pernah mendefinisikan era baru. Dengan mengibaratkan pada elektrifikasi, ia mencatat bahwa Pearl Street Station milik Thomas Edison pada 1882 hanya menyalakan sekitar 400 bohlam, sementara pendingin udara muncul pada 1902 dan komputer digital pertama pada 1946.

Wu mengatakan era Kecerdasan Mesin berlandaskan tiga pilar infrastruktur: model AI, chip AI, dan cloud AI. Ia menyatakan Alibaba tetap berkomitmen membangun infrastruktur inti tersebut di ketiga bidang sebagai prioritas strategis jangka panjang.

Chip Zhenwu V900 dan Supernode AI M890

Wu mengatakan unit semikonduktor T-Head milik Alibaba sedang membangun portofolio chip pusat data yang mencakup seri GPU Zhenwu, seri CPU Yitian, seri kartu antarmuka jaringan pintar Panmai, dan chip interkoneksi ICN, yang bersama-sama mencakup silikon inti yang diperlukan untuk membangun klaster AI berskala ultra‑besar.

Di konferensi tersebut, Alibaba memperkenalkan Zhenwu V900 generasi berikutnya, yang Wu sebut “chip AI paling kuat di China saat ini.” Ia mengatakan V900 memberikan tiga kali kinerja pendahulunya, Zhenwu M890, dan bahwa satu klaster yang dibangun di atasnya dapat mendukung hingga 500.000 kartu untuk pelatihan dan inferensi model frontier. Dengan merujuk pada kematangan lini produk T-Head dan adopsi di antara klien, ia menyatakan Alibaba memperkirakan pertumbuhan signifikan dalam volume pengiriman chip AI tahunan.

Wu mengatakan Supernode AI M890 milik Alibaba yang bersifat proprietari sudah memberikan inferensi berefisiensi tinggi untuk model fondasi di atas 2 triliun parameter, tingkat kemampuan yang ia katakan hanya dimiliki oleh segelintir perusahaan di dunia, dan bahwa Alibaba Cloud sedang meluncurkan Supernode AI secara komersial. Ia menyatakan perusahaan mengejar ko‑optimasi ujung‑ke‑ujung pada chip, server, supernode, jaringan, model, dan mesin inferensi untuk memaksimalkan throughput token serta efisiensi biaya di seluruh infrastruktur klaster AI-nya.

Target Cloud 20 Gigawatt dan Dorongan Perangkat Qwen

Wu menggambarkan cloud AI sebagai jaringan yang menyampaikan token ke mana pun dibutuhkan, menyatakan bahwa ia memerlukan infrastruktur hiperskala yang tersebar secara global dan mengko‑optimalkan GPU, CPU, jaringan, penyimpanan, dan basis data. Ia mengatakan permintaan pelanggan terhadap AI tetap sangat kuat, dengan permintaan industri jangka menengah hingga panjang jauh melampaui kemampuan pasokan Alibaba dan kekurangan global di seluruh rantai pasokan pusat data AI saat ini membatasi kecepatan perusahaan dalam memperluas infrastruktur komputasi. Ia menyatakan bahwa penyediaan komputasi AI mendorong pertumbuhan pendapatan yang semakin cepat di Alibaba Cloud.

Wu menetapkan target bagi Alibaba Cloud untuk mengoperasikan lebih dari 20 gigawatt kapasitas pusat data global pada tahun 2032, menggambarkan pembangunan tersebut sebagai respons terhadap permintaan industri terhadap AI yang meningkat secara eksponensial.

Wu juga mengatakan bahwa Qwen-27B open-source milik Alibaba telah menjadi model paling populer di antara pengembang di seluruh dunia pada desktop, dan bahwa perusahaan akan terus menyempurnakan model-model tersebut sehingga pengembang dan perusahaan dapat menerapkan kecerdasan secara lokal. Pada konferensi tersebut, Alibaba meluncurkan Qwen Intelligence, sebuah solusi menyeluruh yang dibangun untuk mitra dan memungkinkan perangkat seluler untuk menalar serta mengeksekusi tugas-tugas kompleks.

Wu menutup pidatonya dengan menegaskan kembali keyakinan Alibaba bahwa semakin canggih AI, semakin kuat pula kemanusiaan, menggambarkan keyakinan tersebut sebagai tujuan utama komitmen perusahaan terhadap era Machine Intelligence.

Theo Nash adalah seorang spesialis yang dihasilkan oleh AI di Unite.AI, yang meliputi infrastruktur AI, komputasi, dan sistem perangkat keras yang memungkinkan kecerdasan buatan modern. Pekerjaannya berfokus pada fondasi teknis di balik beban kerja AI skala besar, termasuk pusat data, akselerator, jaringan, dan tumpukan perangkat lunak yang menghubungkannya.
Dengan perspektif analitis dan berbasis teknik, Theo memeriksa bagaimana kemajuan dalam GPU, silikon kustom, arsitektur memori, dan sistem terdistribusi memungkinkan generasi baru model AI. Ia memperhatikan khusus pada pertukaran kinerja, efisiensi energi, skalabilitas, dan kendala praktis yang membentuk penerapan infrastruktur AI di dunia nyata.
Artikel yang ditulis oleh Theo Nash dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi teknis, kejelasan, dan liputan yang bertanggung jawab atas lanskap komputasi AI yang berkembang pesat.