Model dan platform AI

HUMAIN yang Didukung PIF Luncurkan Model Bahasa Arab Humain-M3 di LEAP Riyadh

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

HUMAIN, perusahaan kecerdasan buatan yang didukung Public Investment Fund, mengumumkan humain-m3 pada 3 September 2026, memperkenalkan model bahasa Arab frontier di LEAP di Riyadh dan merilisnya dalam pratinjau riset melalui HUMAIN Node. Dipesan oleh HUMAIN dan disampaikan oleh MiniMax, model ini selanjutnya dilatih sebelumnya dengan lebih dari satu triliun token konten berbahasa Arab asli.

humain-m3 adalah model mixture-of-experts dengan 428 miliar parameter yang dibangun di atas garis keturunan MiniMax-M3. Menurut pengumuman HUMAIN, model ini mencapai skor rata-rata tertinggi di antara model frontier yang diuji pada tujuh benchmark publik bahasa Arab, dengan kinerja kuat dalam pemahaman bahasa Arab dan penalaran.

Hasil Benchmark Bahasa Arab

Evaluasi HUMAIN menempatkan checkpoint humain-m3 yang dipratinjau dengan rata-rata 89,37% pada ketujuh benchmark, dengan bobot yang sama, mengungguli GPT-5.6 SOL yang memperoleh 87,30%, Opus 5 dengan 87,34%, dan checkpoint referensi MiniMax M3 dengan 80,34%, menurut tabel hasil yang dipublikasikan di halaman model HUMAIN Node. HUMAIN menyatakan bahwa model pratinjau ini memimpin lima dari tujuh benchmark dibandingkan model frontier terkuat yang dievaluasinya.

Rangkaian benchmark mencakup pemahaman inti, pengetahuan asli dan terjemahan, ujian akademik, kemahiran bahasa, kejujuran, dan generasi berbantuan pengambilan kembali. Dalam hasil HUMAIN, humain-m3 mencetak 86,45% pada AlGhafa untuk pemahaman bahasa Arab inti, 90,70% pada ArabicMMLU untuk pengetahuan luas bahasa Arab asli, 67,67% pada Arabic EXAMS untuk ujian akademik, 95,44% pada MadinahQA untuk kemahiran bahasa Arab, 97,53% pada AraTrust untuk kejujuran dan kepercayaan, 94,63% pada ALRAGE untuk generasi berbantuan pengambilan kembali, dan 93,20% pada Translated MMLU. Perusahaan menyatakan bahwa pasca‑pelatihan bahasa Arabnya menambah sembilan poin rata‑rata dibandingkan model referensi yang menjadi dasar sistem, dan menggambarkan skor tersebut sebagai evaluasi mereka terhadap checkpoint yang dipratinjau.

Arsitektur dan Pelatihan

Halaman Node menjelaskan bahwa humain-m3 mengaktifkan 23 miliar parameter per token dan menggambarkan arsitektur dasarnya sebagai mixture-of-experts multimodal native yang dirancang untuk agen. HUMAIN menyatakan bahwa model ini menangani penggunaan alat frontier dan penggunaan komputer untuk alur kerja agen jangka panjang dalam bahasa Arab dan Inggris, menawarkan tiga mode berpikir — selalu aktif, adaptif, dan nonaktif — serta dilatih secara bersama pada teks, gambar, dan video sejak langkah pertama, dengan pemahaman video panjang dan operasi layar native.

Akses Melalui HUMAIN Node

Pratinjau riset dan evaluasi tersedia melalui HUMAIN Node, platform perusahaan yang memberikan pengembang, peneliti, dan perusahaan akses ke model AI canggih serta kemampuan inferensi. Pengguna dapat mencoba model ini di playground tanpa kode atau memanggil humain-m3 melalui endpoint API yang kompatibel dengan OpenAI.

HUMAIN menyusun akses dalam tingkatan. Membuat akun membuka permintaan akses ke model. Tingkat pratinjau terbatas menyediakan model dengan pengaman penyelarasan Saudi yang diterapkan, dengan mode berpikir dan streaming nonaktif serta beberapa penambahan latensi. Tingkat pratinjau riset menyediakan checkpoint penuh dengan mode berpikir, streaming, dan latensi lebih rendah. HUMAIN menyatakan bahwa periode pratinjau memungkinkan mereka mengevaluasi kemampuan, keamanan, dan penyelarasan lintas dialek Arab bersama pengguna awal sebelum ketersediaan umum, dan bahwa umpan balik pengguna membentuk checkpoint berikutnya.

Model ini merupakan yang pertama terbuka untuk pengguna pratinjau di HUMAIN Node, di mana perusahaan menyatakan lebih dari 100 model frontier, proprietari, dan sumber terbuka dari penyedia terkemuka sudah tersedia di platform dengan akses yang lebih luas akan segera dibuka. Node menawarkan satu API, satu kunci, dan satu tagihan lintas model, batas pengeluaran per tim dan proyek, serta pilihan hosting global, di dalam Kerajaan, atau berdaulat.

Rencana Rilis Bobot Terbuka

HUMAIN mengatakan bahwa mereka mengharapkan bobot model akan dirilis di bawah MiniMax Community License setelah pelatihan keamanan dan penyelarasan selesai, langkah yang saat ini ditargetkan untuk bulan depan. Perusahaan menempatkan pratinjau sebagai cara bagi peneliti dan pengembang untuk menguji model dan memberikan umpan balik sebelum rilis tersebut.

“Bahasa Arab dituturkan oleh ratusan juta orang, namun masih sangat kurang terwakili di frontier kecerdasan buatan,” kata Tareq Amin, CEO HUMAIN. “Dengan humain-m3, kami berinvestasi untuk mengubah hal itu.”

HUMAIN mengatakan peluncuran ini menggabungkan dua elemen strategi intelijen mereka: mengembangkan kemampuan AI kelas dunia untuk bahasa Arab dan membuat intelijen frontier lebih mudah diakses melalui HUMAIN Node. Bersamaan dengan model dan produk mereka sendiri, termasuk keluarga model Arab ALLAM, perusahaan menyatakan bahwa mereka berinvestasi dan bekerja sama dengan perusahaan AI terkemuka secara global untuk memperluas akses ke kemampuan AI canggih.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.