Was Alibaba in Schanghai ankündigte
Am 19. Juli zeigte Alibabas Qwen-Team auf der World AI Conference in Schanghai eine Vorschau von Qwen3.8-Max, dem nächsten Spitzenmodell der Qwen-Familie. Die Schlagzeile lautet 2,4 Billionen Parameter, und es ist das erste multimodale Modell des Teams oberhalb einer Billion, das Text, Bilder, Video und Dokumente in einem System verarbeitet.
Alibaba sieht es nur hinter Claude Fable 5 und erklärt, es verbessere Qwen3.7-Max beim Programmieren, in der Full-Stack-Entwicklung, in der Datenanalyse und bei Büro-Arbeitsabläufen. Eine Vorschau ist über Alibabas Token Plan, Qoder und QoderWork zu 10 Prozent des Standardpreises verfügbar, und das Unternehmen hat offene Gewichte für bald zugesagt, ohne ein Datum zu nennen.
Die fehlende Zahl bestimmt den Preis Ihrer Arbeitslast
Warum das wichtig ist: 2,4 Billionen ist die Zahl, die berichtet wird, und die Zahl, die Ihnen am wenigsten sagt. Große Spitzenmodelle dieser Bauart sind dünnbesetzte Mixture-of-Experts-Systeme, bei denen für jede Anfrage nur ein Teil der Parameter arbeitet. Die Gesamtzahl beschreibt, wie viel Modell vorhanden ist. Die Zahl der aktiven Parameter beschreibt, wie viel davon läuft, und damit, wie viel Rechenleistung jede Anfrage verbraucht.
Diese Zahl hat Alibaba nicht genannt. Diese eine Auslassung macht die angekündigte Größe für die Planung unbrauchbar: Ein Modell mit 2,4 Billionen Parametern und kleinem aktivem Anteil lässt sich günstiger betreiben als ein weit kleineres dichtes Modell, eines mit großem aktivem Anteil weit teurer. Wer aus der Schlagzeilenzahl ein Budget ableitet, rechnet mit einer Zahl, die beeindrucken und nicht informieren soll.
Eine Rangbehauptung, für die noch nichts spricht
Die Behauptung von Platz zwei verdient dieselbe Skepsis. Alibaba nennt einen konkreten Wettbewerber, Claude Fable 5, und stellt sich direkt darunter, ohne Benchmark-Ergebnisse vorzulegen, die diese Einordnung stützen.
Das ist die Umkehrung des Musters, dem man trauen kann. Als Moonshot Kimi K3 veröffentlichte, wies die eigene Ankündigung dem Modell Platz zwei insgesamt zu, und unabhängige Tests auf Arena.ai setzten es danach bei Frontend-Code auf Platz eins. Ein Anbieter, dessen eigene Behauptung zurückhaltender ausfällt als das unabhängige Ergebnis, liefert Ihnen ein brauchbares Signal. Ein Anbieter, dessen Behauptung ohne jedes unabhängige Ergebnis kommt, liefert eine Pressezeile. Bis die öffentlichen Ranglisten Qwen3.8-Max bewerten, ist die Einordnung Alibabas Meinung über Alibaba.
Lesen Sie den Rabatt als das, was er ist
Unter dem Strich: Eine Vorschau zu 10 Prozent des Listenpreises ist eine Einladung zum Testen, kein Angebot, darauf zu bauen. Der Preis erfüllt einen Zweck, nämlich echte Arbeitslasten schnell genug auf ein unbewiesenes Modell zu holen, um die Auswertungsbelege zu erzeugen, die zum Start fehlten.
Daran ist nichts Anstößiges, und für ein europäisches Team mit freien Testkapazitäten kann es ein günstiger Weg sein, etwas zu lernen. Der Fehler liegt darin, den Rabattpreis für die Wirtschaftlichkeit des Modells zu halten. Vorschaupreise enden, der Standardpreis liegt zehnmal höher, und jeder Geschäftsfall, der auf der Aktionszahl beruht, kippt in dem Moment, in dem die Vorschau schließt. Wenn Sie testen, testen Sie mit Ihrer eigenen Arbeitslast und erfassen Sie die Kosten zum vollen Listenpreis, nicht zum Einführungspreis.
Bald ist kein Datum, der Vergleich hat eines
Das Versprechen offener Gewichte hat die klarste Folge für alle, die ihre Unabhängigkeit von einer gehosteten API abwägen. Alibaba sagt, die Gewichte kämen bald, und legt sich nicht fest. Moonshot hat erklärt, die vollständigen Gewichte von Kimi K3 kämen am 27. Juli.
Für einen Betreiber, dem wichtig ist, ein Modell auf selbst kontrollierter Infrastruktur betreiben zu können, sind diese beiden Aussagen nicht vergleichbar. Die eine ist ein Plan mit einem Datum, das Sie in den Kalender eintragen und an dem Sie einen Anbieter messen können. Die andere ist eine Absicht. Wenn Sie chinesische Spitzenmodelle überhaupt deshalb beobachten, weil offene Gewichte Ihnen erlauben, selbst zu hosten, zu prüfen und zu wechseln, dann bringt eine Freigabe ohne Datum dieses Ziel noch nicht voran, wie groß die daran hängende Parameterzahl auch sein mag.
Weiterlesen: Unabhängige Tests reihen Kimi K3 vor Fable 5 | Moonshots größtes Modell hat keinen Regler fürs Denken



