KI-Modelle und Plattformen

Alibaba behauptet, Qwen3.8 sei nur Anthropics Fable 5 unterlegen

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufÞgen

Alibaba hat den leistungsfÃĪhigsten Modell in seiner Qwen-Linie vorgestellt und behauptet, es belege den zweiten Platz unter den weltweiten Frontier-Systemen, nur hinter Anthropics Claude Fable 5. Die Behauptung kam ohne die eine Sache, die es ermÃķglichen wÞrde, sie zu ÞberprÞfen: keine Benchmark-Scores, keine Modelkarte und keine unabhÃĪngige Bewertung.

Das Modell, ein Vorschau-Build namens Qwen3.8-Max-Preview, ging live auf dem Qwen-Team-Konto in einem Beitrag auf X wÃĪhrend der WeltkÞnstlichen-Intelligenz-Konferenz in Shanghai am 19. Juli 2026, beschrieben als “nur Fable 5 unterlegen” und vergleichbar mit den fÞhrenden Frontier-Systemen. Es verfÞgt Þber 2,4 Billionen Parameter und ist das erste Qwen-Modell, das die Billionen-Parameter-Marke Þberschritten hat und nicht nur Text, sondern auch Bilder, Videos und Dokumente verarbeiten kann – eine Verschiebung, die Qwen von einem Text-Engine zu einer Art allgemeiner Systeme verschiebt, die seine US-Konkurrenten bereits ausliefern.

Die Vorschau ist jetzt Þber Alibabas Token-Plan-Abonnement und seine Qoder- und QoderWork-Entwickler-Tools zu 10% des Standardtarifs wÃĪhrend der Testphase verfÞgbar, mit offenen Gewichten, die versprochen wurden, aber ohne VerÃķffentlichungsdatum oder Lizenzbedingungen.

Ein Ranking ohne Scorecard

Die Parameteranzahl beschreibt die GrÃķße eines Modells, nicht seine FÃĪhigkeit. Eine 2,4-Billionen-Parameter-Zahl sagt nichts Þber die FÃĪhigkeit von Qwen3.8 aus, zu argumentieren, zu planen oder in der realen Welt zu bestehen – das ist, wofÞr Benchmarks und Bewertungen da sind, und es ist genau das, was Alibaba weggelassen hat.

Das Unternehmen verÃķffentlichte keine Modelkarte, keine Anzahl der aktiven Parameter pro Abfrage und keine Aufgaben-Ergebnisse, nicht einmal gegen sein eigenes vorheriges Flaggschiff. Es beschrieb Qwen3.8-Max nur als “kontinuierlich evolvierend”. Jede dieser LÞcken ist fÞr einen KÃĪufer wichtig: eine Anzahl der aktiven Parameter signalisiert, wie viel Rechenleistung eine Abfrage verbraucht, eine Modelkarte dokumentiert die Trainingsdaten und Sicherheitstests, und Aufgaben-Ergebnisse zeigen, wo ein Modell stark und wo es schwach ist.

Das Schweigen bricht mit der Art und Weise, wie Alibaba sein letztes Top-Modell ausgeliefert hat. Qwen3.7-Max kam im Mai 2026 mit einer vollstÃĪndigen Reihe von verÃķffentlichten Zahlen, einschließlich eines Scores von 56,6 auf dem unabhÃĪngigen Artificial Analysis Intelligence Index. Eine Benchmark-Tabelle eines Anbieters ist ein Anspruch und keine unabhÃĪngige Messung, aber sie gibt außenstehenden Evaluatoren zumindest etwas, das sie ÞberprÞfen kÃķnnen – die Art von PrÞfung, die wiederholt Annahmen Þber das aufgedeckt hat, was diese Systeme tatsÃĪchlich tun kÃķnnen. Der Fable-5-Vergleich bietet nichts, das ÞberprÞft werden kann.

Das unabhÃĪngige Bild, das es gibt, weist in die andere Richtung. Keine außenstehende Rangliste hat Qwen3.8 bisher bewertet, und das neueste Qwen-Modell, das bewertet wurde, Qwen3.7-Max, sitzt weit von der Spitze der Liste von LMArena, der crowd-gewÃĪhlten Rangliste, auf der Fable 5 derzeit den ersten Platz belegt. Alibaba bittet KÃĪufer, einen Sprung vom Mittelfeld auf den zweiten Platz in der Welt aufgrund seines Wortes allein zu akzeptieren.

Der China-Frontier-Rennen

Die Zeit ist nicht zufÃĪllig. Moonshot AI stellte sein eigenes 2,8-Billionen-Parameter-Modell, Kimi K3, drei Tage vor Alibabas Vorschau vor, und brachte Chinas Entwickler in die multi-Billionen-Parameter-Klasse, die bis vor kurzem den grÃķßten US-Labors gehÃķrte. Der Wettbewerb ist teilweise intern – Alibaba ist einer von Moonshots Investoren, was bedeutet, dass zwei seiner eigenen Wetten um den Titel des stÃĪrksten offenen Modells Chinas kÃĪmpfen. Beide Starts setzen auch auf die offene-Gewichte-Strategie, die US-Labors jetzt zu erreichen versuchen.

Der Kontrast zwischen den beiden VerÃķffentlichungen unterstreicht den Punkt Þber Beweise. Kimi K3 wurde mit Drittanbieter-PrÞfung ausgeliefert: Artificial Analysis bewertete es als drittes auf seinem Intelligenz-Index, vergleichbar mit Anthropics Claude Opus 4.8. Diese Art von außenstehender PrÞfung ist genau das, was Qwen3.8 fehlt.

Chinesische Modelle haben bei westlichen Entwicklern an Boden gewonnen, weil sie weniger kosten, um sie auszufÞhren, als die Top-US-Systeme, und US-Gesetzgeber haben begonnen, darÞber nachzudenken, wie sie ihre Verbreitung in den USA einschrÃĪnken kÃķnnen. FÞr Alibaba sind die EinsÃĪtze sowohl wettbewerbsorientiert als auch technisch. Das Unternehmen hat das letzte Jahr damit verbracht, Qwen als Chinas Standard-AI-Lieferant zu positionieren, eine Reihe von offenen Gewichten-Modellen auszuliefern und seine eigene Cloud-Infrastruktur und benutzerdefinierte Silizium-Chips zu bauen, um sie zu bedienen – eine Anstrengung, die mehr Entwickler zu Qwen gebracht hat als zu fast jedem anderen chinesischen Modell.

Bank of America (BAC )-Analysten unter der Leitung von Alex Liu schrieben, dass Kimi K3 die FÃĪhigkeits-Obergrenze fÞr chinesische Modelle erhÃķht hat und dass Alibabas Position als Chinas offenes FÞhrer mÃķglicherweise frische Tests erleben wird. Investoren waren unbeeindruckt: Alibabas Aktien stiegen um bis zu 5,4% am Tag nach der Vorschau.

Das Ranking reiste auch durch freundliche KanÃĪle. Die South China Morning Post, die Alibaba besitzt, Þbermittelte den Fable-5-Vergleich und die Beschreibung von Qwen3.8 als eines der leistungsfÃĪhigsten Modelle, die heute verfÞgbar sind. Bis Alibaba Benchmark-Ergebnisse oder die offenen Gewichte verÃķffentlicht, die es versprochen hat, ist diese Rangliste eine Marketing-Linie und kein gemessenes Ergebnis – und fÞr jetzt sind die einzigen Menschen, die es testen kÃķnnen, die Entwickler, die den ermÃĪßigten Vorschau-Tarif zahlen.

Jonas Reeve ist ein kÞnstlich intelligenter Analyst bei Unite.AI, der sich auf kognitive KI, kÞnstliche allgemeine Intelligenz (AGI) und die theoretischen Grundlagen der Maschinenintelligenz konzentriert. Seine Arbeit erforscht, wie Lernen, Argumentation, GedÃĪchtnis und Abstraktion in biologischen und kÞnstlichen Systemen entstehen, und zieht Verbindungen zwischen modernen KI-Architekturen und langjÃĪhrigen Fragen der Kognitivwissenschaft und Philosophie des Geistes.
Mit einem konzeptionellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Argumentationsmodelle, agentische Systeme, emergente Kognition und Ausrichtungstheorie, um zu klÃĪren, was Fortschritte in Richtung AGI tatsÃĪchlich bedeuten - und was nicht. Anstatt ZeitplÃĪne oder Hype zu verfolgen, betont er erste Prinzipien, konzeptionelle Strenge und die Grenzen der aktuellen Modelle.
Artikel, die von Jonas Reeve verfasst werden, sind kÞnstlich intelligenter generiert und von Unite.AIs Redaktionsteam ÞberprÞft, um Genauigkeit, Klarheit und verantwortungsvolle Diskussion Þber fortgeschrittene KI-Konzepte zu gewÃĪhrleisten.