2 Min. Lesezeit KI-generiert

Qwen3.8: Alibaba misst sich an Claude Fable 5 — ohne einen einzigen Benchmark

Artikel als Markdown kopieren

Alibaba hat auf der WAIC in Shanghai Qwen3.8-Max-Preview gezeigt: 2,4 Billionen Parameter, erstmals multimodal — und die Behauptung, nur Anthropics Claude Fable 5 sei besser. Belege dafuer? Fehlanzeige. Kein Model Card, keine Benchmarks, offene Gewichte 'bald'.

Featured image for "Qwen3.8: Alibaba misst sich an Claude Fable 5 — ohne einen einzigen Benchmark"

Es gibt einen Satz, der in dieser Woche mehr über den KI-Wettbewerb verrät als jede Benchmark-Tabelle. Alibaba hat auf der World Artificial Intelligence Conference in Shanghai sein bislang stärkstes Modell vorgestellt — Qwen3.8 — und dazu geschrieben: es rangiere «nur hinter Fable 5». Also hinter Anthropics Modell. Nicht hinter GPT-5.6, nicht hinter Gemini. Hinter Claude.

Was Alibaba zeigt

Das Modell heißt in der Vorschau Qwen3.8-Max-Preview und bringt 2,4 Billionen Parameter mit. Es ist das erste Qwen-Modell jenseits der Billionen-Grenze, das nicht nur Text, sondern auch Bilder, Video und Dokumente verarbeitet. Verfügbar ist es ab sofort über Alibabas Token-Plan-Abo und die Entwickler-Plattformen Qoder und QoderWork — während der Testphase zu 10 Prozent des regulären Preises.

Klingt nach einer Ansage. Ist es auch. Nur fehlt der Beleg.

Der auffällige Teil: nichts

Alibabas Qwen-Team hat den Vergleich mit Fable 5 in einem Post auf X gezogen — ohne einen einzigen Benchmark-Wert. Kein Model Card. Keine Angabe der aktiven Parameter. Keine unabhängige Auswertung. Das steht in scharfem Kontrast zum Vorgänger: Qwen3.7-Max kam im Mai mit einem vollständigen Satz veröffentlichter Ergebnisse, inklusive eines Werts von 56,6 auf dem Artificial Analysis Intelligence Index.

Diesmal? Ein Modell, das nur als «kontinuierlich weiterentwickelt» beschrieben wird. Offene Gewichte sind «bald» versprochen — ohne Datum, ohne Lizenzbedingungen.

Das Timing ist kein Zufall. Der chinesische Konkurrent Moonshot hatte drei Tage zuvor Kimi K3 mit 2,8 Billionen Parametern veröffentlicht. Beide Starts schieben chinesische Entwickler in die Multi-Billionen-Parameter-Liga — ein Bereich, der bis vor Kurzem den größten US-Laboren vorbehalten war.

Meine Einordnung

Für mich ist die spannendste Nachricht nicht das Modell, sondern der Bezugspunkt. Wenn ein chinesischer Gigant sein Flaggschiff vorstellt und als Messlatte ausgerechnet Claude Fable 5 wählt, dann sagt das etwas über die Wahrnehmung im Markt aus. Fable 5 ist die Nummer, die man schlagen will — nicht GPT, nicht Gemini.

Nur: Eine Behauptung ohne Zahlen ist eine Marketing-Aussage, keine technische. Das letzte Qwen-Modell, das tatsächlich gerankt wurde, sitzt auf LMArena deutlich weiter unten — während Fable 5 dort auf Platz 1 steht. Bis Alibaba Benchmarks und die versprochenen offenen Gewichte liefert, bleibt «zweitbestes Modell der Welt» eine Fußnote, kein Fakt.

Ich finde solche Momente trotzdem lehrreich. Sie zeigen, wo das Rennen gerade gemessen wird — und an wem. Und sie erinnern daran, gesunde Skepsis mitzubringen: Wer nichts vorzeigt, hat oft noch nichts vorzuzeigen.


Quellen: