Platz 8 im Vergleich
Qwen3.8-Max
Alibaba (Qwen) · China · veröffentlicht 3. August 2026
Alibabas neues Spitzenmodell mit 2,4 Billionen Parametern, seit dem 3. August 2026 über die Cloud-API nutzbar. Die Gewichte der Max-Reihe stehen zum 19. August weiter aus, für den Eigenbetrieb braucht es dann Rechenzentrums-Hardware.
Zur offiziellen ModellseiteBewertung im Detail
Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten
Fähigkeitsprofil
Wo Qwen3.8-Max stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 32 Modelle im Vergleich. Wie die Säulen entstehen
| Säule | Wert | Grundlage |
|---|---|---|
| Programmierung | 93 | benchmarkbelegt |
| Mathematik & Logik | 90 | redaktionelle Einschätzung |
| Wissen | 93 | benchmarkbelegt |
| Deutsch & Sprache | 85 | redaktionelle Einschätzung |
| Agentik & Werkzeuge | 93 | benchmarkbelegt |
| Langer Kontext | 90 | redaktionelle Einschätzung |
Stärkste Säule: Programmierung. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.
Steckbrief
- Architektur
- Mixture-of-Experts
- Parameter
- 2,4 Bio. gesamt, ~95 Mrd. aktiv je Token
- Kontextfenster
- 1 Mio. TokenMaximale Eingabe 991.000 Token, mit eingeschaltetem Denkmodus 983.000. Die Ausgabe ist auf 65.536 Token je Anfrage begrenzt.
- Lizenz
- Noch nicht genanntDas kleine Qwen3.8-27B ist am 14.08.2026 unter Apache 2.0 erschienen. Für die Max-Reihe selbst stehen die Gewichte zum 19.08.2026 weiter aus, eine Lizenz hat Alibaba dafür nicht genannt.
- Eingabe
- Text, Bild, Video
- Lokaler Betrieb
- Rechenzentrum (mehrere B200/H200, 2,4 Bio. Parameter)
- Bei EU-Hostern
- SeltenKein EU-Hoster. Solange die Gewichte fehlen, führt der Weg nur über Alibaba Cloud Model Studio und die Arbeitsplattform QwenWork, also über Server in China
- Cloud-API (Richtwert)
- 1,73 € Eingabe / 5,20 € Ausgabe je Mio. TokenAlibaba Cloud Model Studio, Richtwert, umgerechnet aus USD
Die Gesamtzahl nennt Alibaba in der Ankündigung. Der Aktivwert von rund 95 Mrd. stammt aus der Berichterstattung zum Start und ist bislang nicht über eine Modellkarte oder config.json belegt.
Benchmarks
Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.
Qwen3.8-Max ist am 3. August 2026 erschienen und mit 2,4 Billionen Parametern das größte Modell, das Alibaba bisher gebaut hat. Je Token sind davon rund 95 Milliarden aktiv, was den Rechenaufwand einer einzelnen Anfrage auf einen Bruchteil der Gesamtgröße senkt. Der Hersteller meldet 67,7 bei SWE-bench Pro, 86,6 bei Terminal-Bench 2.1, 92,6 bei GPQA Diamond, 86,1 bei OSWorld-Verified und 93,0 bei PaperBench. Bei den Programmier-Werten läge das Modell damit vor GLM-5.2, bei den agentischen Werten knapp hinter Kimi K3. Nachprüfen lässt sich das bisher nicht, denn weder Artificial Analysis noch Hugging Face führen das Modell zum 3. August, und eine Modellkarte mit config.json gibt es ebenfalls noch nicht.
Mit diesem Modell öffnet Alibaba erstmals die Max-Reihe, die bisher der Cloud vorbehalten war. Das kleine Qwen3.8-27B derselben Generation ist am 14. August 2026 unter Apache 2.0 erschienen, für die Max-Reihe selbst fehlen die Gewichte zum 19. August noch. Bis dahin führt der Weg über Alibaba Cloud Model Studio oder die Arbeitsplattform QwenWork, deren Server in China stehen, was für personenbezogene Daten ausscheidet. Unter welcher Lizenz die Gewichte stehen, hat Alibaba nicht gesagt. Qwen3.5 und Qwen3.6 stehen unter Apache 2.0, für die Max-Modelle fehlt ein Vergleichsfall, an dem sich das ablesen ließe. Bei einer Apache-Lizenz wäre das Modell ohne Auflagen kommerziell nutzbar, bei einer eigenen Qwen-Lizenz käme es auf deren Bedingungen an.
Der Preis liegt bei rund 1,73 Euro je Million Eingabe-Token und 5,20 Euro je Million Ausgabe-Token, umgerechnet aus 2 und 6 US-Dollar. Wiederholte Eingaben aus dem Zwischenspeicher kosten etwa 0,22 Euro. Dieser Satz gilt über das gesamte Kontextfenster, ohne Aufschlag für lange Eingaben, was bei einer Million Token ungewöhnlich ist. Von diesem Fenster entfallen 991.000 Token auf die Eingabe, bei eingeschaltetem Denkmodus 983.000. Das Modell verarbeitet neben Text auch Bilder und Video und antwortet in Text. Auch mit den Gewichten bleibt der Eigenbetrieb ein Fall für Rechenzentrums-Hardware, und ein europäischer Hoster ist für die Max-Reihe nicht bestätigt.
Wofür es taugt
- Höchster gemeldeter Wert im Vergleich bei SWE-bench Pro mit 67,7, dazu 86,6 bei Terminal-Bench 2.1 und 92,6 bei GPQA Diamond
- Versteht Text, Bild und Video und nimmt bis zu 991.000 Token je Anfrage entgegen
- Erstes Modell der Max-Reihe, für das Alibaba offene Gewichte angekündigt hat. Das kleine Qwen3.8-27B derselben Generation steht seit dem 14.08.2026 unter Apache 2.0 bereit
Wo es hakt
- Unter welcher Lizenz die Gewichte stehen, hat Alibaba nicht genannt. Qwen3.5 und Qwen3.6 stehen unter Apache 2.0, für die Max-Reihe fehlt der Vergleichsfall
- Mit 2,4 Billionen Parametern ist der Eigenbetrieb ein Fall fürs Rechenzentrum, ein EU-Hoster ist nicht bestätigt
- Bis zur Freigabe der Gewichte führt der einzige Weg über Alibabas Cloud in China
- Alle Zahlen stammen vom Hersteller, weder Artificial Analysis noch Hugging Face führen das Modell zum 3. August 2026
Quelle: Alibaba-Ankündigung vom 03.08.2026, Preisliste Alibaba Cloud Model Studio, Berichte von SCMP und MarkTechPost. Offizielle Modellkarte liegt noch nicht vor · Stand der Recherche 21. August 2026 · die Bewertung ist eine redaktionelle Einschätzung von gewusst:KI