Zum Inhalt springen
Alle Modelle im Vergleich

Platz 9 im Vergleich

Qwen3.8-Max

Alibaba (Qwen) · China · veröffentlicht 3. August 2026

89 % Gesamtbewertung

Alibabas Spitzenmodell mit 2,4 Billionen Parametern, seit dem 3. August 2026 über die Cloud-API nutzbar. Am 12. August sind die Gewichte als Qwen3.8-2.4T-A95B nachgekommen, das erste Mal überhaupt für ein Modell der Max-Reihe. Diese offene Fassung versteht allerdings nur Text und bringt das Millionen-Token-Fenster der API nicht mit. Für den Eigenbetrieb braucht es Rechenzentrums-Hardware.

Zur offiziellen Modellseite

Bewertung im Detail

Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten

Leistung (55 %) 94 %
DSGVO- und EU-Eignung (30 %) 82 %
Lizenz-Offenheit (15 %) 85 %

Fähigkeitsprofil

Wo Qwen3.8-Max stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 25 Modelle im Vergleich. Wie die Säulen entstehen

Coding 93 Mathe & Logik 90* Wissen 93 Deutsch 85* Agentik 93 Kontext 90*
Qwen3.8-Max Median aller Modelle * redaktionelle Einschätzung (kein belegter Benchmark)
Fähigkeitsprofil von Qwen3.8-Max, Werte von 0 bis 100
SäuleWertGrundlage
Programmierung93benchmarkbelegt
Mathematik & Logik90redaktionelle Einschätzung
Wissen93benchmarkbelegt
Deutsch & Sprache85redaktionelle Einschätzung
Agentik & Werkzeuge93benchmarkbelegt
Langer Kontext90redaktionelle Einschätzung
Programmierung 93
Code schreiben und debuggen, ganze Repositories über viele Schritte bearbeiten
Wissen 93
Fach- und Allgemeinwissen über viele Domänen hinweg
Agentik & Werkzeuge 93
Werkzeuge selbständig aufrufen und mehrstufige Abläufe steuern
Mathematik & Logik · Einschätzung 90
mehrstufiges Rechnen und logisches Schließen mit prüfbarer Lösung
Langer Kontext · Einschätzung 90
nutzbare Leistung über sehr lange Eingaben, nicht nur die Fenstergröße
Deutsch & Sprache · Einschätzung 85
Sprachverständnis und Mehrsprachigkeit, mit Blick auf Deutsch

Stärkste Säule: Programmierung. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.

Steckbrief

Architektur
Mixture-of-Experts
Parameter
2,4 Bio. gesamt, ~95 Mrd. aktiv je Token
Kontextfenster
1 Mio. TokenÜber die API maximale Eingabe 991.000 Token, mit eingeschaltetem Denkmodus 983.000, die Ausgabe ist auf 65.536 Token je Anfrage begrenzt. Die offene Fassung Qwen3.8-2.4T-A95B bringt dieses Fenster nicht mit.
Lizenz
Qwen3.8-Max LicenseEigene Lizenz von Alibaba, nicht das Apache 2.0 des kleinen Qwen3.8-27B. Nutzung im eigenen Unternehmen ist frei. Ab 100 Mio. monatlichen Nutzern oder 20 Mio. US-Dollar Monatsumsatz muss der Modellname auf der Oberfläche stehen, und wer Modelle oder einen KI-Assistenten als Dienst anbietet und dabei über 50 Mio. US-Dollar in 12 Monaten umsetzt, braucht eine bezahlte Lizenz.
Eingabe
Text, Bild, Video (offene Gewichte nur Text)
Lokaler Betrieb
Rechenzentrum (mehrere B200/H200, 2,4 Bio. Parameter)
Bei EU-Hostern
SeltenKein EU-Hoster. Die Gewichte liegen seit dem 12.08.2026 als Qwen3.8-2.4T-A95B auf Hugging Face, die volle Fassung mit Bild und Video gibt es nur über Alibaba Cloud Model Studio und die Arbeitsplattform QwenWork, also über Server in China
Cloud-API (Richtwert)
1,73 € Eingabe / 5,20 € Ausgabe je Mio. TokenAlibaba Cloud Model Studio, Richtwert, umgerechnet aus USD

Die Gesamtzahl nennt Alibaba in der Ankündigung. Der Aktivwert von rund 95 Mrd. stammt aus der Berichterstattung zum Start und ist bislang nicht über eine Modellkarte oder config.json belegt.

Benchmarks

Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.

67,7 SWE-bench Pro
86,6 Terminal-Bench 2.1
92,6 GPQA Diamond
86,1 OSWorld-Verified

Qwen3.8-Max ist am 3. August 2026 erschienen und mit 2,4 Billionen Parametern das größte Modell, das Alibaba bisher gebaut hat. Je Token sind davon rund 95 Milliarden aktiv, was den Rechenaufwand einer einzelnen Anfrage auf einen Bruchteil der Gesamtgröße senkt. Der Hersteller meldet 67,7 bei SWE-bench Pro, 86,6 bei Terminal-Bench 2.1, 92,6 bei GPQA Diamond, 86,1 bei OSWorld-Verified und 93,0 bei PaperBench. Bei den Programmier-Werten läge das Modell damit vor GLM-5.2, bei den agentischen Werten knapp hinter Kimi K3. Nachprüfen lässt sich das bisher nicht, denn weder Artificial Analysis noch Hugging Face führen das Modell zum 3. August, und eine Modellkarte mit config.json gibt es ebenfalls noch nicht.

Mit diesem Modell öffnet Alibaba erstmals die Max-Reihe, die bisher der Cloud vorbehalten war. Das kleine Qwen3.8-27B derselben Generation ist am 14. August 2026 unter Apache 2.0 erschienen, für die Max-Reihe selbst fehlen die Gewichte zum 19. August noch. Bis dahin führt der Weg über Alibaba Cloud Model Studio oder die Arbeitsplattform QwenWork, deren Server in China stehen, was für personenbezogene Daten ausscheidet. Unter welcher Lizenz die Gewichte stehen, hat Alibaba nicht gesagt. Qwen3.5 und Qwen3.6 stehen unter Apache 2.0, für die Max-Modelle fehlt ein Vergleichsfall, an dem sich das ablesen ließe. Bei einer Apache-Lizenz wäre das Modell ohne Auflagen kommerziell nutzbar, bei einer eigenen Qwen-Lizenz käme es auf deren Bedingungen an.

Der Preis liegt bei rund 1,73 Euro je Million Eingabe-Token und 5,20 Euro je Million Ausgabe-Token, umgerechnet aus 2 und 6 US-Dollar. Wiederholte Eingaben aus dem Zwischenspeicher kosten etwa 0,22 Euro. Dieser Satz gilt über das gesamte Kontextfenster, ohne Aufschlag für lange Eingaben, was bei einer Million Token ungewöhnlich ist. Von diesem Fenster entfallen 991.000 Token auf die Eingabe, bei eingeschaltetem Denkmodus 983.000. Das Modell verarbeitet neben Text auch Bilder und Video und antwortet in Text. Auch mit den Gewichten bleibt der Eigenbetrieb ein Fall für Rechenzentrums-Hardware, und ein europäischer Hoster ist für die Max-Reihe nicht bestätigt.

Wofür es taugt

  • Höchster gemeldeter Wert im Vergleich bei SWE-bench Pro mit 67,7, dazu 86,6 bei Terminal-Bench 2.1 und 92,6 bei GPQA Diamond
  • Versteht Text, Bild und Video und nimmt bis zu 991.000 Token je Anfrage entgegen
  • Erstes Modell der Max-Reihe mit offenen Gewichten, seit dem 12.08.2026 auf Hugging Face. Das kleine Qwen3.8-27B derselben Generation steht unter Apache 2.0 bereit

Wo es hakt

  • Die offene Fassung Qwen3.8-2.4T-A95B versteht nur Text und hat weder Bildverständnis noch das Millionen-Token-Fenster der API
  • Eigene Lizenz statt Apache 2.0, mit Umsatzschwelle für Anbieter von Modell-Diensten und Namensnennung ab 100 Mio. Nutzern
  • Mit 2,4 Billionen Parametern ist der Eigenbetrieb ein Fall fürs Rechenzentrum, ein EU-Hoster ist nicht bestätigt
  • Alle Zahlen stammen vom Hersteller, Artificial Analysis führt das Modell zum 04.09.2026 nicht

Quelle: Alibaba-Ankündigung vom 03.08.2026, HF-Modellkarte Qwen/Qwen3.8-2.4T-A95B samt Lizenzdatei vom 12.08.2026, Preisliste Alibaba Cloud Model Studio, Berichte von SCMP und MarkTechPost · Stand der Recherche 16. September 2026 · die Bewertung ist eine redaktionelle Einschätzung von neuost