Qwen3.8-Max
Alibaba (Qwen) · China · veröffentlicht 3. August 2026
Alibabas neues Spitzenmodell mit 2,4 Billionen Parametern, seit dem 3. August 2026 über die Cloud-API nutzbar. Mit der Freigabe der Gewichte Mitte August öffnet Alibaba erstmals die Max-Reihe, für den Eigenbetrieb braucht es dann Rechenzentrums-Hardware.
Zur offiziellen ModellseiteBewertung im Detail
Gesamtnote aus drei gewichteten Dimensionen. Wie wir bewerten
Fähigkeitsprofil
Wo Qwen3.8-Max stark ist, über sechs Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 31 Modelle im Vergleich. Wie die Säulen entstehen
| Säule | Wert | Grundlage |
|---|---|---|
| Programmierung | 93 | benchmarkbelegt |
| Mathematik & Logik | 90 | redaktionelle Einschätzung |
| Wissen | 93 | benchmarkbelegt |
| Deutsch & Sprache | 85 | redaktionelle Einschätzung |
| Agentik & Werkzeuge | 93 | benchmarkbelegt |
| Langer Kontext | 90 | redaktionelle Einschätzung |
Stärkste Säule: Programmierung. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.
Steckbrief
- Architektur
- Mixture-of-Experts
- Parameter
- 2,4 Bio. gesamt, ~95 Mrd. aktiv je Token
- Kontextfenster
- 1 Mio. TokenMaximale Eingabe 991.000 Token, mit eingeschaltetem Denkmodus 983.000. Die Ausgabe ist auf 65.536 Token je Anfrage begrenzt.
- Lizenz
- Noch nicht genanntDie Gewichte für Qwen3.8-Max und Qwen3.8-27B sind für die Woche nach dem Start angekündigt, die Lizenz hat Alibaba dabei nicht genannt. Qwen3.5 und Qwen3.6 stehen unter Apache 2.0, für die Max-Reihe gab es bisher keine offene Fassung.
- Eingabe
- Text, Bild, Video
- Lokaler Betrieb
- Rechenzentrum (mehrere B200/H200, 2,4 Bio. Parameter)
- Bei EU-Hostern
- SeltenKein EU-Hoster. Bis zur Freigabe der Gewichte Mitte August 2026 nur über Alibaba Cloud Model Studio und die Arbeitsplattform QwenWork erreichbar, also über Server in China
- Cloud-API (Richtwert)
- 1,73 € Eingabe / 5,20 € Ausgabe je Mio. TokenAlibaba Cloud Model Studio, Richtwert, umgerechnet aus USD
Die Gesamtzahl nennt Alibaba in der Ankündigung. Der Aktivwert von rund 95 Mrd. stammt aus der Berichterstattung zum Start und ist bislang nicht über eine Modellkarte oder config.json belegt.
Benchmarks
Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.
Qwen3.8-Max ist am 3. August 2026 erschienen und mit 2,4 Billionen Parametern das größte Modell, das Alibaba bisher gebaut hat. Je Token sind davon rund 95 Milliarden aktiv, was den Rechenaufwand einer einzelnen Anfrage auf einen Bruchteil der Gesamtgröße senkt. Der Hersteller meldet 67,7 bei SWE-bench Pro, 86,6 bei Terminal-Bench 2.1, 92,6 bei GPQA Diamond, 86,1 bei OSWorld-Verified und 93,0 bei PaperBench. Bei den Programmier-Werten läge das Modell damit vor GLM-5.2, bei den agentischen Werten knapp hinter Kimi K3. Nachprüfen lässt sich das bisher nicht, denn weder Artificial Analysis noch Hugging Face führen das Modell zum 3. August, und eine Modellkarte mit config.json gibt es ebenfalls noch nicht.
Mit diesem Modell öffnet Alibaba erstmals die Max-Reihe, die bisher der Cloud vorbehalten war. Die Gewichte folgen in der Woche nach dem Start, zusammen mit einem kleinen Qwen3.8-27B für eine einzelne Grafikkarte. Bis dahin führt der Weg über Alibaba Cloud Model Studio oder die Arbeitsplattform QwenWork, deren Server in China stehen, was für personenbezogene Daten ausscheidet. Welche Lizenz die Gewichte tragen, hat Alibaba nicht gesagt. Qwen3.5 und Qwen3.6 stehen unter Apache 2.0, für die Max-Modelle fehlt ein Vergleichsfall, an dem sich das ablesen ließe. Bei einer Apache-Lizenz wäre das Modell ohne Auflagen kommerziell nutzbar, bei einer eigenen Qwen-Lizenz käme es auf deren Bedingungen an.
Der Preis liegt bei rund 1,73 Euro je Million Eingabe-Token und 5,20 Euro je Million Ausgabe-Token, umgerechnet aus 2 und 6 US-Dollar. Wiederholte Eingaben aus dem Zwischenspeicher kosten etwa 0,22 Euro. Dieser Satz gilt über das gesamte Kontextfenster, ohne Aufschlag für lange Eingaben, was bei einer Million Token ungewöhnlich ist. Von diesem Fenster entfallen 991.000 Token auf die Eingabe, bei eingeschaltetem Denkmodus 983.000. Das Modell verarbeitet neben Text auch Bilder und Video und antwortet in Text. Auch mit den Gewichten bleibt der Eigenbetrieb ein Fall für Rechenzentrums-Hardware, und ein europäischer Hoster ist für die Max-Reihe nicht bestätigt.
Stärken
- +Höchster gemeldeter Wert im Vergleich bei SWE-bench Pro mit 67,7, dazu 86,6 bei Terminal-Bench 2.1 und 92,6 bei GPQA Diamond
- +Versteht Text, Bild und Video und nimmt bis zu 991.000 Token je Anfrage entgegen
- +Erstes Modell der Max-Reihe mit offenen Gewichten, zusammen mit einem kleinen Qwen3.8-27B für eine einzelne Grafikkarte
Grenzen
- −Welche Lizenz die Gewichte tragen, hat Alibaba nicht genannt. Qwen3.5 und Qwen3.6 stehen unter Apache 2.0, für die Max-Reihe fehlt der Vergleichsfall
- −Mit 2,4 Billionen Parametern ist der Eigenbetrieb ein Fall fürs Rechenzentrum, ein EU-Hoster ist nicht bestätigt
- −Bis zur Freigabe der Gewichte führt der einzige Weg über Alibabas Cloud in China
- −Alle Zahlen stammen vom Hersteller, weder Artificial Analysis noch Hugging Face führen das Modell zum 3. August 2026
Quelle: Alibaba-Ankündigung vom 03.08.2026, Preisliste Alibaba Cloud Model Studio, Berichte von SCMP und MarkTechPost. Offizielle Modellkarte liegt noch nicht vor. Stand der Recherche: 14. August 2026. Die Prozent-Bewertung ist eine redaktionelle Einschätzung von gewusst:KI.
Lokale KI im eigenen Unternehmen aufbauen
Wir begleiten die Auswahl des passenden Modells, die Hardware-Planung und den Betrieb, lokal oder bei einem europäischen Hoster. Einen Einstieg bietet unser Workshop zu lokaler KI oder ein direktes Gespräch.