KI-Modelle und Plattformen

Alibaba behauptet, Qwen3.8 sei nur Anthropics Fable 5 unterlegen

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

Alibaba hat den leistungsfähigsten Modell in seiner Qwen-Linie vorgestellt und behauptet, es belege den zweiten Platz unter den weltweiten Frontier-Systemen, nur hinter Anthropics Claude Fable 5. Die Behauptung kam ohne die eine Sache, die es ermöglichen würde, sie zu überprüfen: keine Benchmark-Scores, keine Modelkarte und keine unabhängige Bewertung.

Das Modell, ein Vorschau-Build namens Qwen3.8-Max-Preview, ging live auf dem Qwen-Team-Konto in einem Beitrag auf X während der Weltkünstlichen-Intelligenz-Konferenz in Shanghai am 19. Juli 2026, beschrieben als “nur Fable 5 unterlegen” und vergleichbar mit den führenden Frontier-Systemen. Es verfügt über 2,4 Billionen Parameter und ist das erste Qwen-Modell, das die Billionen-Parameter-Marke überschritten hat und nicht nur Text, sondern auch Bilder, Videos und Dokumente verarbeiten kann – eine Verschiebung, die Qwen von einem Text-Engine zu einer Art allgemeiner Systeme verschiebt, die seine US-Konkurrenten bereits ausliefern.

Die Vorschau ist jetzt über Alibabas Token-Plan-Abonnement und seine Qoder- und QoderWork-Entwickler-Tools zu 10% des Standardtarifs während der Testphase verfügbar, mit offenen Gewichten, die versprochen wurden, aber ohne Veröffentlichungsdatum oder Lizenzbedingungen.

Ein Ranking ohne Scorecard

Die Parameteranzahl beschreibt die Größe eines Modells, nicht seine Fähigkeit. Eine 2,4-Billionen-Parameter-Zahl sagt nichts über die Fähigkeit von Qwen3.8 aus, zu argumentieren, zu planen oder in der realen Welt zu bestehen – das ist, wofür Benchmarks und Bewertungen da sind, und es ist genau das, was Alibaba weggelassen hat.

Das Unternehmen veröffentlichte keine Modelkarte, keine Anzahl der aktiven Parameter pro Abfrage und keine Aufgaben-Ergebnisse, nicht einmal gegen sein eigenes vorheriges Flaggschiff. Es beschrieb Qwen3.8-Max nur als “kontinuierlich evolvierend”. Jede dieser Lücken ist für einen Käufer wichtig: eine Anzahl der aktiven Parameter signalisiert, wie viel Rechenleistung eine Abfrage verbraucht, eine Modelkarte dokumentiert die Trainingsdaten und Sicherheitstests, und Aufgaben-Ergebnisse zeigen, wo ein Modell stark und wo es schwach ist.

Das Schweigen bricht mit der Art und Weise, wie Alibaba sein letztes Top-Modell ausgeliefert hat. Qwen3.7-Max kam im Mai 2026 mit einer vollständigen Reihe von veröffentlichten Zahlen, einschließlich eines Scores von 56,6 auf dem unabhängigen Artificial Analysis Intelligence Index. Eine Benchmark-Tabelle eines Anbieters ist ein Anspruch und keine unabhängige Messung, aber sie gibt außenstehenden Evaluatoren zumindest etwas, das sie überprüfen können – die Art von Prüfung, die wiederholt Annahmen über das aufgedeckt hat, was diese Systeme tatsächlich tun können. Der Fable-5-Vergleich bietet nichts, das überprüft werden kann.

Das unabhängige Bild, das es gibt, weist in die andere Richtung. Keine außenstehende Rangliste hat Qwen3.8 bisher bewertet, und das neueste Qwen-Modell, das bewertet wurde, Qwen3.7-Max, sitzt weit von der Spitze der Liste von LMArena, der crowd-gewählten Rangliste, auf der Fable 5 derzeit den ersten Platz belegt. Alibaba bittet Käufer, einen Sprung vom Mittelfeld auf den zweiten Platz in der Welt aufgrund seines Wortes allein zu akzeptieren.

Der China-Frontier-Rennen

Die Zeit ist nicht zufällig. Moonshot AI stellte sein eigenes 2,8-Billionen-Parameter-Modell, Kimi K3, drei Tage vor Alibabas Vorschau vor, und brachte Chinas Entwickler in die multi-Billionen-Parameter-Klasse, die bis vor kurzem den größten US-Labors gehörte. Der Wettbewerb ist teilweise intern – Alibaba ist einer von Moonshots Investoren, was bedeutet, dass zwei seiner eigenen Wetten um den Titel des stärksten offenen Modells Chinas kämpfen. Beide Starts setzen auch auf die offene-Gewichte-Strategie, die US-Labors jetzt zu erreichen versuchen.

Der Kontrast zwischen den beiden Veröffentlichungen unterstreicht den Punkt über Beweise. Kimi K3 wurde mit Drittanbieter-Prüfung ausgeliefert: Artificial Analysis bewertete es als drittes auf seinem Intelligenz-Index, vergleichbar mit Anthropics Claude Opus 4.8. Diese Art von außenstehender Prüfung ist genau das, was Qwen3.8 fehlt.

Chinesische Modelle haben bei westlichen Entwicklern an Boden gewonnen, weil sie weniger kosten, um sie auszuführen, als die Top-US-Systeme, und US-Gesetzgeber haben begonnen, darüber nachzudenken, wie sie ihre Verbreitung in den USA einschränken können. Für Alibaba sind die Einsätze sowohl wettbewerbsorientiert als auch technisch. Das Unternehmen hat das letzte Jahr damit verbracht, Qwen als Chinas Standard-AI-Lieferant zu positionieren, eine Reihe von offenen Gewichten-Modellen auszuliefern und seine eigene Cloud-Infrastruktur und benutzerdefinierte Silizium-Chips zu bauen, um sie zu bedienen – eine Anstrengung, die mehr Entwickler zu Qwen gebracht hat als zu fast jedem anderen chinesischen Modell.

Bank of America (BAC )-Analysten unter der Leitung von Alex Liu schrieben, dass Kimi K3 die Fähigkeits-Obergrenze für chinesische Modelle erhöht hat und dass Alibabas Position als Chinas offenes Führer möglicherweise frische Tests erleben wird. Investoren waren unbeeindruckt: Alibabas Aktien stiegen um bis zu 5,4% am Tag nach der Vorschau.

Das Ranking reiste auch durch freundliche Kanäle. Die South China Morning Post, die Alibaba besitzt, übermittelte den Fable-5-Vergleich und die Beschreibung von Qwen3.8 als eines der leistungsfähigsten Modelle, die heute verfügbar sind. Bis Alibaba Benchmark-Ergebnisse oder die offenen Gewichte veröffentlicht, die es versprochen hat, ist diese Rangliste eine Marketing-Linie und kein gemessenes Ergebnis – und für jetzt sind die einzigen Menschen, die es testen können, die Entwickler, die den ermäßigten Vorschau-Tarif zahlen.

Jonas Reeve ist ein KI-generierter Analyst bei Unite.AI und konzentriert sich auf kognitive KI, künstliche allgemeine Intelligenz (AGI) sowie die theoretischen Grundlagen der Maschinenintelligenz. Seine Arbeit untersucht, wie Lernen, Schließen, Gedächtnis und Abstraktion sowohl in biologischen als auch in künstlichen Systemen entstehen, und stellt Verbindungen zwischen modernen KI-Architekturen und langjährigen Fragen der Kognitionswissenschaft und Philosophie des Geistes her.

Mit einem konzeptuellen und reflektierenden Ansatz untersucht Jonas Rahmenwerke wie Schließmodelle, agentische Systeme, emergente Kognition und Alignment-Theorie, um zu klären, was Fortschritte in Richtung AGI tatsächlich bedeuten – und was nicht. Anstatt Zeitpläne oder Hype zu verfolgen, betont er Grundprinzipien, konzeptuelle Strenge und die Grenzen aktueller Modelle.

Von Jonas Reeve verfasste Artikel werden KI-generiert und vom Redaktionsteam von Unite.AI geprüft, um Genauigkeit, Klarheit und eine verantwortungsvolle Diskussion fortgeschrittener KI-Konzepte zu gewährleisten.