AI-modeller og platforme

Alibaba hævder, Qwen3.8 er kun overgået af Anthropics Fable 5

mm
Føj Unite.AI til dine foretrukne kilder på Google

Alibaba har præsenteret den mest kapable model i sin Qwen-linje og siger, det rangerer som nummer to blandt verdens frontier-systemer, kun overgået af Anthropics Claude Fable 5. Påstanden kom uden den ene ting, der ville lade nogen tjekke det: ingen benchmark-scores, ingen modelkort og ingen uafhængig vurdering.

Modellen, en preview-bygning kaldet Qwen3.8-Max-Preview, gik live på Qwen-holdets konto i en post på X under Verdens Kunstig Intelligens Konference i Shanghai den 19. juli 2026, beskrevet som “kun overgået af Fable 5” og sammenlignelig med de førende frontier-systemer. Den har 2,4 billioner parametre og er den første Qwen-model, der kan håndtere billeder, video og dokumenter, ikke kun tekst – en skift, der flytter Qwen fra en tekstmotor til den slags generelle formålssystemer, som dens amerikanske rivaler allerede leverer.

Previewen er tilgængelig nu gennem Alibabas Token Plan-abonnement og dets Qoder og QoderWork-udviklerværktøjer til 10% af den standardrate under prøveperioden, med åbne vægte loved, men ingen frigivelsesdato eller licensbetingelser offentliggjort.

En rangering uden scorekort

Parameterantal beskriver en models størrelse, ikke dens færdighed. Et tal på 2,4 billioner parametre siger intet om, hvordan Qwen3.8 resonnerer, planlægger eller holder til på rigtigt arbejde – det er, hvad benchmarks og vurderinger er til, og det er præcis, hvad Alibaba udelod.

Selskabet offentliggjorde ingen modelkort, ingen optælling af, hvor mange parametre der er aktive på hver forespørgsel, og ingen opgave-niveau-resultater, ikke engang mod sin egen tidligere flagskib. Det beskrev Qwen3.8-Max kun som “kontinuerligt udviklet”. Hvert af disse huller er vigtigt for en køber: en aktiveret-parameter-optælling signalerer, hvor meget beregning en forespørgsel brænder, en modelkort dokumenterer træningsdata og sikkerhedstest, og opgave-niveau-scores viser, hvor en model er stærk og hvor den ikke er.

Denne tavshed afviger fra, hvordan Alibaba leverede sin sidste topmodel. Qwen3.7-Max ankom i maj 2026 med en fuld sæt offentliggjorte tal, herunder en score på 56,6 på den uafhængige Artificial Analysis Intelligence Index. En vendors egen benchmark-tabel er en påstand snarere end en uafhængig måling, men den giver i det mindste udenforstående evaluatorer noget at arbejde med – den slags gennemgang, der gentagne gange hævdrede antagelser om, hvad disse systemer kan. Fable 5-sammenligningen tilbyder intet at tjekke.

Den uafhængige billed, der findes, peger den anden vej. Ingen udenforstående leaderboard har rangeret Qwen3.8 endnu, og den seneste Qwen-model, der blev vurderet, Qwen3.7-Max, sidder langt fra toppen af LMArena‘s liste, den crowd-voted leaderboard, hvor Fable 5 for øjeblikket holder førstepladsen. Alibaba beder købere om at acceptere et spring fra midten af pakken til nummer to i verden på sin ord.

Den kinesiske frontier-løb

Tidspunktet er ikke tilfældigt. Moonshot AI afslørede sin egen 2,8 billioner parametre-model, Kimi K3, tre dage før Alibabas preview, flyttede Kinas udviklere ind i den multi-trillion-parameter-klasse, der indtil for nylig tilhørte de største amerikanske laboratorier. Rivaliseringen er delvist internt – Alibaba er blandt Moonshots bagmænd, hvilket efterlader to af sine egne bud, der kæmper for titlen som Kinas stærkeste åbne model. Begge lanceringer hviler også på den åbne-vægt-strategi, som amerikanske laboratorier nu kapløber for at matche.

Kontrasten mellem de to udgivelser skærper pointen om bevis. Kimi K3 blev leveret med tredjeparts-gennemgang: Artificial Analysis vurderede det som nummer tre på sin intelligens-index, sammenlignelig med Anthropics Claude Opus 4.8. Den slags ydre check er præcis, hvad Qwen3.8 mangler.

Kinesiske modeller har vundet ground hos vestlige udviklere delvist, fordi de koster mindre at køre end de top-amerikanske systemer, og amerikanske lovgivere har begyndt at overveje, hvordan de kan begrænse deres antagelse hjemme. For Alibaba er indsatsen konkurrencemæssig såvel som teknisk. Selskabet har brugt det sidste år på at positionere Qwen som Kinas standard-AI-leverandør, leverer en konstant strøm af åbne-vægt-modeller og bygger sin egen sky-infrastruktur og brugerdefineret silicium til at betjene dem – en indsats, der har tiltrukket flere udviklere til Qwen end til næsten enhver anden kinesisk model-familie.

Bank of America (BAC )-analytikere ledet af Alex Liu skrev, at Kimi K3 har hævet kapacitetsloftet for kinesiske modeller, og at Alibabas position som landets åbne kilde-leverandør kan stå over for friske tests. Investorerne var upåvirkede: Alibabas aktier steg med op til 5,4% dagen efter previewet.

Rangeringen rejste også gennem venlige kanaler. Den South China Morning Post, som Alibaba ejer, formidlede Fable 5-sammenligningen og selskabets beskrivelse af Qwen3.8 som en af de mest kraftfulde modeller, der er tilgængelige i dag. Indtil Alibaba offentliggør benchmarks eller de åbne vægte, det har lovet, er den rangering en marketing-linje snarere end en målt result – og for nu er det kun udviklerne, der betaler den rabatterede preview-sats, der kan teste det.

Jonas Reeve er en AI-genereret analytiker hos Unite.AI, med fokus på kognitiv AI, kunstig generel intelligens (AGI) og de teoretiske grundlag for maskinintelligens. Hans arbejde undersøger, hvordan læring, ræsonnement, hukommelse og abstraktion opstår i både biologiske og kunstige systemer, og trækker forbindelser mellem moderne AI-arkitekturer og langvarige spørgsmål inden for kognitiv videnskab og sindets filosofi.

Med en konceptuel og reflekterende tilgang undersøger Jonas rammer som ræsonneringsmodeller, agentbaserede systemer, emergent kognition og justeringsteori, med det formål at tydeliggøre, hvad fremskridt mod AGI faktisk betyder – og hvad det ikke gør. I stedet for at jagte tidslinjer eller hype lægger han vægt på første principper, konceptuel stringens og begrænsningerne i de nuværende modeller.

Artikler skrevet af Jonas Reeve er AI-genererede og gennemgået af Unite.AI’s redaktionsteam for at sikre nøjagtighed, klarhed og ansvarlig diskussion af avancerede AI-koncept.