Zum Inhalt springen
Alle Modelle im Vergleich

Platz 15 im Vergleich

Laguna S 2.1

Poolside · USA, Hauptsitz Paris · veröffentlicht 21. Juli 2026

86 % Gesamtbewertung

Poolsides offenes Modell für Programmierarbeit. Von 118 Mrd. Parametern sind nur 8 pro Token aktiv, deshalb reicht in 4-Bit-Quantisierung eine einzelne Workstation mit rund 59 GB. Bei SWE-bench Multilingual meldet Poolside 78,5 %.

Zur offiziellen Modellseite

Bewertung im Detail

Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten

Leistung (55 %) 84 %
DSGVO- und EU-Eignung (30 %) 84 %
Lizenz-Offenheit (15 %) 100 %

Fähigkeitsprofil

Wo Laguna S 2.1 stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 32 Modelle im Vergleich. Wie die Säulen entstehen

Coding 89 Mathe & Logik 70* Wissen 72* Deutsch 72* Agentik 80 Kontext 85*
Laguna S 2.1 Median aller Modelle * redaktionelle Einschätzung (kein belegter Benchmark)
Fähigkeitsprofil von Laguna S 2.1, Werte von 0 bis 100
SäuleWertGrundlage
Programmierung89benchmarkbelegt
Mathematik & Logik70redaktionelle Einschätzung
Wissen72redaktionelle Einschätzung
Deutsch & Sprache72redaktionelle Einschätzung
Agentik & Werkzeuge80benchmarkbelegt
Langer Kontext85redaktionelle Einschätzung
Programmierung 89
Code schreiben und debuggen, ganze Repositories über viele Schritte bearbeiten
Langer Kontext · Einschätzung 85
nutzbare Leistung über sehr lange Eingaben, nicht nur die Fenstergröße
Agentik & Werkzeuge 80
Werkzeuge selbständig aufrufen und mehrstufige Abläufe steuern
Wissen · Einschätzung 72
Fach- und Allgemeinwissen über viele Domänen hinweg
Deutsch & Sprache · Einschätzung 72
Sprachverständnis und Mehrsprachigkeit, mit Blick auf Deutsch
Mathematik & Logik · Einschätzung 70
mehrstufiges Rechnen und logisches Schließen mit prüfbarer Lösung

Stärkste Säule: Programmierung. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.

Steckbrief

Architektur
Mixture-of-Experts
Parameter
118 Mrd. gesamt, 8 Mrd. aktiv je Token
Kontextfenster
1 Mio. TokenNativ, im Denk- wie im Direktmodus.
Lizenz
OpenMDW-1.1Permissive Modell-Lizenz der Linux Foundation. Nutzen, Ändern und Weitergeben ohne Auflagen, kommerziell wie nicht kommerziell.
Eingabe
Text
Lokaler Betrieb
Eine RTX PRO 6000 (96 GB), DGX Spark oder Mac Studio (4 Bit, rund 59 GB)
Bei EU-Hostern
SeltenKein EU-Hoster bestätigt, Betrieb auf dem eigenen Server quantisiert auf einer Workstation
Cloud-API (Richtwert)
0,09 € Eingabe / 0,18 € Ausgabe je Mio. TokenOpenRouter, Richtwert, umgerechnet aus USD

Architektur aus der Modellkarte belegt (256 geroutete Experten, davon 10 aktiv, plus ein geteilter Experte, 48 Lagen, davon 36 mit gleitendem Aufmerksamkeitsfenster).

Benchmarks

Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.

78,5 SWE-bench Multilingual
70,2 Terminal-Bench 2.1
59,4 SWE-bench Pro
49,7 Toolathlon Verified

Wofür es taugt

  • Hohe Coding-Leistung bei nur 8 Mrd. aktiven Parametern, in 4 Bit rund 59 GB Speicherbedarf
  • OpenMDW-1.1 der Linux Foundation, kommerzielle Nutzung ohne Auflagen
  • 1 Mio. Token Kontext, offizielle Quantisierungen für FP8, INT4, GGUF und MLX
  • Sehr günstige Cloud-API (0,09 Euro je Mio. Eingabe-Token)

Wo es hakt

  • Alle Benchmark-Werte stammen aus Poolsides eigenem Agenten-Aufbau, unabhängige Messungen fehlen bislang
  • Auf Programmierung ausgelegt, für Mathematik, Wissen und Deutsch veröffentlicht Poolside keine Werte
  • Kein europäischer Hoster bestätigt, das Modell ist erst seit Juli 2026 verfügbar

Quelle: Offizielle HF-Modellkarte poolside/Laguna-S-2.1 und Poolside-Blog, Juli 2026 · Stand der Recherche 21. August 2026 · die Bewertung ist eine redaktionelle Einschätzung von gewusst:KI