Model dan platform AI
Alibaba Meluncurkan Qwen-Image-3.0 Tanpa Benchmarks atau Weights

Tim Qwen dari Alibaba merilis Qwen-Image-3.0 pada 21 Juli 2026, generasi ketiga dari model pembangkit gambar, dan membangun pengumuman di sekitar satu tujuan: membuat gambar yang dihasilkan cukup praktis untuk digunakan sebagai alat kerja daripada hanya enak dilihat. Posting peluncuran adalah galeri apa yang dapat dilakukan sistem – halaman surat kabar yang padat, infografis multi-panel, dan makalah akademis penuh dengan notasi matematika. Yang tidak termasuk adalah skor benchmark, kartu model, atau laporan teknis untuk mendukung semuanya.
Itu adalah cerita. Klaim utama Qwen-Image-3.0 sepenuhnya bergantung pada gambar contoh yang dipilih perusahaan, dan model sebelumnya dalam seri yang sama menetapkan standar yang lebih tinggi untuk bukti daripada yang ini capai.
Apa yang Model Klaim untuk Dilakukan
Tim Qwen mengatur rilis di sekitar tiga kemampuan. Yang pertama adalah menangani prompt yang panjang dan terperinci: model menerima instruksi hingga 4.500 token, yang menurut perusahaan memungkinkan komposisi gambar yang padat dengan informasi dalam satu langkah. Contoh utamanya adalah grid tiga-oleh-tiga infografis yang tidak terkait – diagram fisika, bukti teori grup, penjelasan biologi, dan enam lainnya – yang Alibaba katakan dihasilkan dari satu instruksi 3.700 token daripada disusun dari gambar terpisah. Contoh lain mengatur antarmuka di dalam satu sama lain, meletakkan editor kode di sekitar jendela obrolan di sekitar aplikasi perpesanan.
Klaim kedua adalah detail halus. Alibaba mengatakan model merender teks sekecil 10 piksel dengan jelas dan mereproduksi tekstur seperti kulit, rambut, dan kertas dekat dengan kualitas fotografi. Postingan menampilkan halaman penuh makalah akademis dengan persamaan multi-baris dan halaman depan surat kabar yang disimulasikan, bersama dengan tugas penyuntingan seperti menambahkan anotasi tulisan tangan dan memulihkan lukisan tradisional yang rusak.
Yang ketiga adalah apa yang disebut perusahaan sebagai pengetahuan dunia: rendering asli 12 bahasa, reproduksi antarmuka seperti halaman web dan siaran langsung, dan kemampuan untuk mengambil data langsung dari internet. Salah satu contoh menghasilkan grafik prakiraan cuaca untuk kota dan tanggal tertentu, yang tidak biasa untuk generator dan yang memburamkan garis antara model gambar dan alat desain yang didorong data. Alibaba memasarkan keseluruhan paket pada pekerjaan produksi konten – tata letak surat kabar, papan cerita drama pendek, mockup antarmuka pengguna, dan gambar e-niaga – jenis output media di mana pertanyaan tentang pengungkapan peran AI sudah hidup. Setiap kemampuan ini, bagaimanapun, ditunjukkan melalui output yang dipilih perusahaan.
Apa yang Pengumuman Tinggalkan
Postingan tidak membawa tabel benchmark, hitungan parameter, lisensi, atau bobot yang dapat diunduh, dan tidak ada laporan teknis yang menjelaskan bagaimana model dilatih atau diuji. Pengguna diarahkan ke Qwen Chat untuk mencobanya.
Itu adalah penyimpangan dari cara seri sebelumnya dikirim. Qwen-Image 1.0 tiba pada Agustus 2025 dengan bobot terbuka di bawah lisensi Apache 2.0 yang permissif dan laporan teknis pada hari yang sama, dan Qwen-Image-2.0 mengikuti dengan laporan teknisnya sendiri. Versi sebelumnya juga menyatakan batasannya: itu menerima prompt hingga sekitar 1.000 token, yang membuat lompatan ke 4.500 menjadi angka konkrit paling nyata dalam rilis baru, dan satu yang tidak diverifikasi oleh pihak luar.
Gap itu lebih penting untuk model gambar daripada model teks. Kualitas gambar bersifat subjektif, dan rendering teks adalah tepat di mana generator cenderung terlihat kuat dalam demo yang dipilih dan lebih lemah dalam pengujian sistematis. Tanpa bobot atau set evaluasi, satu-satunya bukti yang dapat digunakan pengembang adalah reel output Alibaba sendiri. Pesaing telah menunjukkan bahwa debut hanya obrolan adalah pilihan daripada keterbatasan: Tencent merilis HunyuanImage 3.0 sebagai model bobot terbuka, dan Thinking Machines Lab baru-baru ini meluncurkan Inkling, model AI multimodal bobot terbuka pertamanya, dengan bobot termasuk.
Di Mana Generasi Terakhir Berperingkat
Alibaba memiliki titik data yang baru dan tidak biasa jujur tentang di mana model gambar mereka berdiri. Dalam Qwen-Image-Bench, evaluasi teks-ke-gambar yang diterbitkan tim Qwen sendiri, bendera sebelumnya, Qwen Image 2.0 Pro, menempati peringkat kelima secara keseluruhan. GPT Image 2 dari OpenAI memimpin peringkat, dengan model Nano Banana dari Google dan GPT Image 1.5 dari OpenAI mengisi empat besar. Benchmark ini bergantung pada model hakim otomatis yang penulisnya katakan melacak penilaian manusia dengan dekat, tetapi tetap merupakan tes milik Alibaba, dan itu menilai generasi sebelumnya, bukan 3.0.
Itu konteks bekerja melawan membaca model baru sebagai lompatan ke depan bidang. Posisi awal peringkat kelima memberi Qwen-Image-3.0 ruang untuk mengklaim keuntungan nyata, tetapi peluncuran tidak menawarkan cara untuk mengonfirmasi mereka. Sinyal yang layak ditonton adalah apakah Alibaba memposting bobot dan kartu model, seperti yang dilakukan untuk setiap rilis Qwen-Image sebelumnya, dan apakah evaluasi independen mendukung klaim prompt panjang dan teks kecil. Sampai salah satunya tiba, yang paling dapat dikatakan adalah Qwen-Image-3.0 terlihat kuat dalam gambar yang dipilih pembuatnya untuk ditampilkan.












