Zum Inhalt springen
Alle Modelle im Vergleich

Platz 19 im Vergleich

Ornith 1.5 35B-A3B

Ornith (DeepReinforce) · Sitz nicht öffentlich genannt · veröffentlicht 19. August 2026

85 % Gesamtbewertung

Ein auf Programmieraufgaben spezialisiertes Mixture-of-Experts, das mit 3 Milliarden aktiven Parametern auf einer einzelnen Grafikkarte läuft. Ornith meldet dafür 79,0 auf SWE-bench Verified und damit mehr als Qwen3.6-35B-A3B. Unabhängig nachgemessen hat das bisher niemand, und eine öffentliche Nachrechnung kam auf mehreren Tests deutlich tiefer heraus.

Modell auf Hugging Face ansehen

Bewertung im Detail

Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten

Leistung (55 %) 82 %
DSGVO- und EU-Eignung (30 %) 84 %
Lizenz-Offenheit (15 %) 100 %

Fähigkeitsprofil

Wo Ornith 1.5 35B-A3B stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 32 Modelle im Vergleich. Wie die Säulen entstehen

Coding 85 Mathe & Logik 80* Wissen 92 Deutsch 78* Agentik 80 Kontext 80*
Ornith 1.5 35B-A3B Median aller Modelle * redaktionelle Einschätzung (kein belegter Benchmark)
Fähigkeitsprofil von Ornith 1.5 35B-A3B, Werte von 0 bis 100
SäuleWertGrundlage
Programmierung85benchmarkbelegt
Mathematik & Logik80redaktionelle Einschätzung
Wissen92benchmarkbelegt
Deutsch & Sprache78redaktionelle Einschätzung
Agentik & Werkzeuge80benchmarkbelegt
Langer Kontext80redaktionelle Einschätzung
Wissen 92
Fach- und Allgemeinwissen über viele Domänen hinweg
Programmierung 85
Code schreiben und debuggen, ganze Repositories über viele Schritte bearbeiten
Mathematik & Logik · Einschätzung 80
mehrstufiges Rechnen und logisches Schließen mit prüfbarer Lösung
Agentik & Werkzeuge 80
Werkzeuge selbständig aufrufen und mehrstufige Abläufe steuern
Langer Kontext · Einschätzung 80
nutzbare Leistung über sehr lange Eingaben, nicht nur die Fenstergröße
Deutsch & Sprache · Einschätzung 78
Sprachverständnis und Mehrsprachigkeit, mit Blick auf Deutsch

Stärkste Säule: Wissen. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.

Steckbrief

Architektur
Mixture-of-Experts
Parameter
36 Mrd. gesamt, 3 Mrd. aktiv je Token
Kontextfenster
256K TokenPer YaRN auf rund 1 Mio. Token erweiterbar.
Lizenz
MIT
Eingabe
Text, Bild
Lokaler Betrieb
Eine GPU (ab 24 GB, RTX 4090, Q4)
Bei EU-Hostern
SeltenKein EU-Hoster bestätigt, Betrieb auf eigener Hardware

Die Modellkarte nennt 35,95 Mrd. Parameter, der Modellname rundet auf 35B ab.

Benchmarks

Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.

79,0 SWE-bench Verified
59,6 SWE-bench Pro
89,2 GPQA Diamond
67,8 Terminal-Bench 2.1

Ornith 1.5 35B-A3B ist am 19. August 2026 erschienen und richtet sich an Programmierarbeit, die über viele Schritte läuft. Von 36 Milliarden Parametern rechnen je Token nur 3 Milliarden, deshalb antwortet das Modell schnell. Als Basis dient Qwen3.5, auf dem der Anbieter weiter trainiert hat. Gemeldet werden 79,0 bei SWE-bench Verified, 59,6 bei SWE-bench Pro und 89,2 bei GPQA Diamond.

Für den Betrieb reicht eine Grafikkarte mit 24 GB, in der Q4-Quantisierung belegt das Modell rund 22 GB. Alle 36 Milliarden Gewichte müssen dabei in den Speicher, obwohl je Token nur 3 Milliarden rechnen. Die Lizenz ist MIT, ohne Umsatzklausel und ohne regionale Beschränkung. Neben Text verarbeitet das Modell auch Bilder, dafür liegt bei den quantisierten Fassungen eine eigene Datei bei. Das Kontextfenster reicht nativ bis 256.000 Token und per YaRN bis rund eine Million. Einen europäischen Anbieter mit fertigem Endpunkt gibt es bislang nicht, der Betrieb läuft auf eigener Hardware.

Die Benchmark-Werte stammen sämtlich vom Anbieter, Artificial Analysis führt das Modell nicht, und eine öffentlich dokumentierte Nachrechnung kam bei mehreren Tests deutlich niedriger heraus als die Modellkarte. Wer hinter Ornith steht, ist nur teilweise geklärt. Als Gründer wird Jiwei Li genannt, einen Firmensitz nennt keine offizielle Quelle. Den Vorgänger Ornith 1.0 haben wir im August 2026 selbst getestet. Das Modell fand mehr Fehler als jedes andere im Feld und baute bei der Reparatur einen neuen ein, der schwerer wog als der ursprüngliche.

Wofür es taugt

  • Läuft mit 3 Mrd. aktiven Parametern auf einer einzelnen Grafikkarte und antwortet entsprechend schnell
  • MIT-Lizenz, damit ohne Auflagen kommerziell nutzbar und selbst hostbar
  • Verarbeitet neben Text auch Bilder, der Bildteil liegt als eigene Datei bei

Wo es hakt

  • Alle Benchmark-Werte stammen vom Hersteller, eine öffentliche Nachrechnung erreichte auf mehreren Tests deutlich niedrigere Werte
  • Wer hinter dem Modell steht, ist nur teilweise öffentlich, einen Firmensitz nennt der Anbieter nirgends
  • Alle 36 Mrd. Gewichte müssen in den Speicher, obwohl je Token nur 3 Mrd. rechnen

Quelle: Offizielle HF-Modellkarte ornith-ai/Ornith-1.5-35B-A3B vom 18.08.2026, Ankündigung von Ornith vom 19.08.2026 und die Einordnung von explainx.ai, August 2026 · Stand der Recherche 21. August 2026 · die Bewertung ist eine redaktionelle Einschätzung von gewusst:KI