AI-modellen en platforms

Alibaba beweert Qwen3.8 als tweede na Anthropic’s Fable 5

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Alibaba heeft een voorbeeld van de meest capabele model in zijn Qwen-lijn getoond en zegt dat het op de tweede plaats staat onder de wereldwijde frontier-systemen, na alleen Anthropic’s Claude Fable 5. Deze bewering kwam zonder het enige dat zou laten zien of het waar is: geen benchmark-scores, geen modelkaart en geen onafhankelijke evaluatie.

Het model, een voorbeeldversie genaamd Qwen3.8-Max-Preview, werd live gezet op het Qwen-teamaccount in een bericht op X tijdens de World Artificial Intelligence Conference in Shanghai op 19 juli 2026, beschreven als “slechts na Fable 5” en vergelijkbaar met de leidende frontier-systemen. Het heeft 2,4 biljoen parameters en is het eerste Qwen-model dat meer dan een triljoen parameters heeft en niet alleen tekst, maar ook afbeeldingen, video’s en documenten kan verwerken — een verschuiving die Qwen van een tekstengine naar het soort algemene doelsysteem brengt dat zijn Amerikaanse concurrenten al hebben.

De voorbeeld is nu beschikbaar via Alibaba’s Token Plan-abonnement en zijn Qoder- en QoderWork-ontwikkelaarstools tegen 10% van de standaardtarief tijdens de proef, met open gewichten die zijn beloofd, maar zonder releasedatum of licentievoorwaarden.

Een rangschikking zonder scorekaart

Parameter telling beschrijft de grootte van een model, niet zijn vaardigheid. Een telling van 2,4 biljoen parameters zegt niets over hoe Qwen3.8 redeneert, plant of presteert in het echte werk — dat is wat benchmarks en evaluaties voor zijn, en dat is precies wat Alibaba heeft weggelaten.

Het bedrijf publiceerde geen modelkaart, geen telling van hoeveel parameters actief zijn op elke query en geen resultaten op taakniveau, zelfs niet tegen zijn eigen vorige vlaggenschip. Het beschreef Qwen3.8-Max alleen als “continu evoluerend”. Elk van die lacunes is belangrijk voor een koper: een telling van geactiveerde parameters signaleert hoeveel rekenkracht een query verbruikt, een modelkaart documenteert trainingsgegevens en veiligheidstests, en resultaten op taakniveau laten zien waar een model sterk en zwak is.

Die stilte breekt met hoe Alibaba zijn laatste topmodel heeft uitgebracht. Qwen3.7-Max arriveerde in mei 2026 met een complete set van gepubliceerde cijfers, waaronder een score van 56,6 op de onafhankelijke Artificial Analysis Intelligence Index. Een leveranciers eigen benchmarktabel is een bewering in plaats van een onafhankelijke meting, maar het geeft buitenstaanders tenminste iets om te controleren — het soort onderzoek dat herhaaldelijk aannames over wat deze systemen kunnen doen heeft omvergeworpen. De Fable 5-vergelijking biedt niets om te controleren.

Het onafhankelijke beeld dat er is, wijst de andere kant op. Geen enkele buitenlandse ranglijst heeft Qwen3.8 nog gerangschikt, en het meest recente Qwen-model dat is gescoord, Qwen3.7-Max, staat ver van de top van LMArena‘s lijst, de door de menigte gestemde ranglijst waar Fable 5 momenteel de eerste plaats inneemt. Alibaba vraagt kopers om een sprong van het midden van het pakket naar de tweede plaats in de wereld te accepteren op basis van zijn eigen woord.

De China frontier-race

De timing is niet toevallig. Moonshot AI onthulde zijn eigen 2,8-biljoenparametermodel, Kimi K3, drie dagen voor Alibaba’s voorbeeld, waardoor China’s ontwikkelaars in de klasse van meerdere triljoenen parameters terechtkwamen, die tot voor kort aan de grootste Amerikaanse laboratoria behoorden. De rivaliteit is gedeeltelijk in-house — Alibaba is een van de investeerders van Moonshot, wat betekent dat twee van zijn eigen inzetten strijden om de titel van China’s sterkste open model. Beide lanceringen steunen ook op de open-gewichtstrategie die Amerikaanse laboratoria nu proberen te evenaren.

Het contrast tussen de twee releases benadrukt het punt over bewijs. Kimi K3 werd uitgebracht met derdenonderzoek: Artificial Analysis rangschikte het als derde op zijn intelligentie-index, vergelijkbaar met Anthropic’s Claude Opus 4.8. Dat soort buitenste controle is precies wat Qwen3.8 ontbreekt.

Chinese modellen hebben terrein gewonnen bij westerse ontwikkelaars, omdat ze minder kosten om uit te voeren dan de top-Amerikaanse systemen, en Amerikaanse wetgevers zijn begonnen met het overwegen van hoe ze hun adoptie thuis kunnen beperken. Voor Alibaba zijn de inzetten zowel competitief als technisch. Het bedrijf heeft het afgelopen jaar Qwen gepositioneerd als China’s standaard AI-leverancier, door een reeks open-gewichtmodellen uit te brengen en zijn eigen cloud-infrastructuur en aangepaste silicium te bouwen om ze te bedienen — een inspanning die meer ontwikkelaars naar Qwen heeft getrokken dan naar bijna elk ander Chinees model.

Bank of America (BAC )-analisten onder leiding van Alex Liu schreven dat Kimi K3 de capaciteitsgrens voor Chinese modellen heeft verhoogd en dat Alibaba’s positie als leider in open-source in China mogelijk voor nieuwe tests komt te staan. Beleggers werden niet gestoord: Alibaba’s aandelen stegen met maximaal 5,4% de dag na de voorbeeld.

De rangschikking reisde ook via vriendelijke kanalen. De South China Morning Post, die Alibaba bezit, gaf de Fable 5-vergelijking en het bedrijf’s beschrijving van Qwen3.8 als een van de krachtigste modellen die vandaag beschikbaar zijn. Tot Alibaba benchmarks of de open gewichten die het heeft beloofd publiceert, is die rangschikking een marketinglijn in plaats van een gemeten resultaat — en voor nu zijn de enige mensen die het kunnen testen de ontwikkelaars die de gekorte voorbeeldtarief betalen.

Jonas Reeve is een AI-gegenereerde analist bij Unite.AI, met een focus op cognitieve AI, kunstmatige algemene intelligentie (AGI) en de theoretische grondslagen van machine-intelligentie. Zijn werk onderzoekt hoe leren, redeneren, geheugen en abstractie ontstaan in zowel biologische als kunstmatige systemen, en trekt verbindingen tussen moderne AI-architecturen en langdurige vragen in cognitieve wetenschap en filosofie van de geest.
Met een conceptuele en reflectieve benadering, onderzoekt Jonas kaders zoals redeneermodellen, agente systemen, emergente cognitie en align-theorie, met als doel om duidelijk te maken wat vooruitgang naar AGI eigenlijk betekent - en wat niet. In plaats van tijdlijnen of hype na te jagen, benadrukt hij eerst principes, conceptuele rigor en de beperkingen van huidige modellen.
Artikelen geschreven door Jonas Reeve zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om ervoor te zorgen dat ze accurate, duidelijke en verantwoorde discussies over geavanceerde AI-concepten bevatten.