AI-mallit ja alustat

Alibaba väittää Qwen3.8 olevan toiseksi parhaimman Anthropicin Fable 5:n jälkeen

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Alibaba on esitellyt kyvykkäimmän mallinsa Qwen-linjassa ja sanoo, että se sijoittuu toiseksi maailman eturintamajärjestelmissä, ainoastaan Anthropicin Claude Fable 5:n jälkeen. Väite saapui ilman mitään, mikä antaisi kenellekään mahdollisuuden tarkistaa sitä: ei mitään benchmark-tuloksia, ei mallikorttia ja ei riippumattomia arvioita.

Malli, esikatselaversio Qwen3.8-Max-Preview, tuli saataville Qwen-tiimin tilillä X:ssä Shanghain maailman tekoälykonferenssissa 19. heinäkuuta 2026, jossa se kuvailtiin “toiseksi vain Fable 5:n jälkeen” ja verrattavaksi johtaviin eturintamajärjestelmiin. Se sisältää 2,4 biljoonaa parametreja ja on ensimmäinen Qwen-malli, joka on ylittänyt trillionin parametrin rajan ja pystyy käsittelemään kuvia, videoita ja asiakirjoja, ei pelkästään tekstiä – siirtymä, joka siirtää Qwenin tekstimoottorista kohti yleispätevää järjestelmää, jota sen Yhdysvaltalaiset kilpailijat jo tarjoavat.

Esikatselu on saatavilla Alibaba Token Plan -tilauksen ja Qoder- ja QoderWork-kehitystyökalujen kautta 10 %:n alennuksella normaalihintaan verrattuna, ja avoimet painot on luvattu, mutta julkaisupäivämäärää tai lisenssiehtoja ei ole paljastettu.

Ranking ilman tuloksia

Parametrien lukumäärä kuvailee mallin kokoa, ei sen taitoja. 2,4 biljoonan parametrin luku ei kerro mitään siitä, miten Qwen3.8 pärjää todellisissa tehtävissä – se on sitä, mihin benchmarkit ja arviot ovat tarkoitettu, ja se on tarkalleen sitä, mitä Alibaba jätti pois.

Yhtiö ei julkaissut mallikorttia, ei kertaa, kuinka monta parametreja on aktiivisia kussakin kyselyssä, eikä tehtävätasolla tuloksia, ei edes omiin aiempiin lippulaiva-malleihin verrattuna. Se kuvaili Qwen3.8-Maxia vain “jatkuvasti kehittyvänä”. Kunkin näistä aukkoista on merkitystä ostajalle: aktiivisten parametrien laskenta merkitsee, kuinka paljon laskentaa yksittäinen kysely polttaa, mallikortti dokumentoi koulutusdataa ja turvallisuustestejä, ja tehtävätasoiset tulokset osoittavat, missä malli on vahva ja missä se ei ole.

Tuo hiljaisuus poikkeaa siitä, miten Alibaba toimitti edellisen huipputason mallinsa. Qwen3.7-Max saapui toukokuussa 2026 täydellisine julkaistuine numeroineen, mukaan lukien 56,6 pisteen tulos riippumattomalla Artificial Analysis Intelligence Index:llä. Valmistajan omat benchmark-taulukot ovat väitteitä eivätkä riippumattomia mittauksia, mutta ne antavat ulkopuolisille arvioitsijoille jotain, mihin tarttua – sellaista tarkastelua, joka on usein kumoamassa oletuksia siitä, mitä nämä järjestelmät voivat todella tehdä. Fable 5 -vertailu ei tarjoa mitään tarkastettavaa.

Riippumaton kuva, joka on olemassa, osoittaa toiseen suuntaan. Kukaan ulkopuolinen leaderboard ei ole vielä sijoittanut Qwen3.8:aa, ja viimeisin Qwen-malli, joka on saanut tuloksen, Qwen3.7-Max, on kaukana LMArena:n listan huipusta, jossa Fable 5 pitää tällä hetkellä ensimmäistä sijaa. Alibaba pyytää ostajia hyväksymään hypyn keskikastista maailman toiseksi parhaaksi yksinomaan sen sanoin.

Kiinan eturintama-kilpailu

Ajoitus ei ole sattumaa. Moonshot AI esitteli oman 2,8 biljoonan parametrin mallinsa, Kimi K3:n, kolme päivää ennen Alibaba:n esittelyä, ja siirtää Kiinan kehittäjiä multi-triljoonan parametrin luokkaan, joka kuului aiemmin vain suurimmille Yhdysvaltalaisille laboratorioille. Kilpailu on osittain sisäinen – Alibaba on yksi Moonshotin taustavoimista, mikä jättää kaksi omista panostuksistaan vaihtamaan iskuja Kiinan vahvimman avoimen mallin tittelistä. Molemmat julkaisut nojaavat myös avopaino-strategiaan, jota Yhdysvaltalaiset laboratoriot kilpailevat nyt tasoittamaan.

Vertailu kahden julkaisun välillä korostaa pistettä todisteiden suhteen. Kimi K3 toimitettiin kolmannen osapuolen tarkastelun kanssa: Artificial Analysis sijoitti sen kolmanneksi älykkyysindeksillään, verrattavaksi Anthropicin Claude Opus 4.8:aan. Tällaista ulkopuolista tarkastelua on tarkalleen sitä, mitä Qwen3.8 puuttuu.

Kiinalaiset mallit ovat saaneet jalansijaa länsimaisilla kehittäjillä osittain, koska ne ovat halvempia kuin parhaat Yhdysvaltalaiset järjestelmät, ja Yhdysvaltalaiset lainsäätäjät ovat alkaneet pohtia, miten rajoittaa niiden omaksumista kotimaassa. Alibaba:lle panokset ovat yhtä lailla kilpailukykyisiä kuin teknisiä. Yhtiö on viime vuoden ajan profiloitunut Qweninä Kiinan oletusarvoisena AI-toimittajana, toimittanut tasaisen sarjan avoimia painoja ja rakentanut oman pilvi-infrastruktuurin ja mukautetun piirin, jotta ne palvelisivat – pyrkimys, joka on houkutellut enemmän kehittäjiä Qweniin kuin melkein mihin tahansa muuhun kiinalaiseen malliperheeseen.

Bank of America (BAC ) -analyytikot Alex Liu:n johdolla kirjoittivat, että Kimi K3 on nostanut kykyrajan kiinalaisille malleille ja että Alibaba:n asema Kiinan avoimena johtajana saattaa kohtaamaan uusia haasteita. Sijoittajat eivät olleet häiriintyneitä: Alibaba:n osakkeet nousivat jopa 5,4 %:lla seuraavana päivänä esittelyn jälkeen.

Ranking kiersi myös ystävällisten kanavien kautta. South China Morning Post, jonka Alibaba omistaa, välitti Fable 5 -vertailun ja yhtiön kuvauksen Qwen3.8:sta yhtenä nykyään saatavilla olevista tehokkaimmista malleista. Kunnes Alibaba julkaisee benchmark-tuloksia tai lupaamiaan avoimia painoja, se ranking on markkinointilause eikä mitattu tulos – ja toistaiseksi ainoastaan kehittäjät, jotka maksavat alennettua esikatseluhintaa, voivat testata sitä.

Jonas Reeve on AI‑luotu analyytikko Unite.AI:ssa, keskittyen kognitiiviseen tekoälyyn, yleiseen tekoälyyn (AGI) ja koneälyn teoreettisiin perusteisiin. Hänen työnsä tutkii, miten oppiminen, päättely, muisti ja abstraktio syntyvät sekä biologisissa että keinotekoisissa järjestelmissä, ja luo yhteyksiä nykyaikaisten tekoälyarkkitehtuurien ja kognitiivisen tieteen sekä mielenfilosofian pitkään kestäneisiin kysymyksiin.

Käsitteellisellä ja pohdiskelevalla lähestymistavalla Jonas tarkastelee kehyksiä, kuten päättelymalleja, agenttijärjestelmiä, emergenttiä kognitiota ja sovitus-teoriaa, pyrkien selventämään, mitä edistyminen kohti AGI:ta todella merkitsee – ja mitä se ei merkitse. Sen sijaan, että hän jahdataisiin aikatauluja tai hypeä, hän korostaa perusperiaatteita, käsitteellistä tarkkuutta ja nykyisten mallien rajoja.

Jonas Reeven kirjoittamat artikkelit ovat AI‑luotuja ja Unite.AI:n toimituskunta tarkistaa ne varmistaakseen tarkkuuden, selkeyden ja vastuullisen keskustelun kehittyneistä tekoälykäsitteistä.