Zum Inhalt springen
Alle Modelle im Vergleich
Platz 22 im Vergleich

IBM Granite 4.1

IBM · USA · veröffentlicht 29. April 2026

79 % Gesamtbewertung

IBMs offene Modellfamilie für den Unternehmenseinsatz: dichte Modelle von 3B bis 30B, dazu Vision, Speech und Embeddings, alle unter Apache 2.0 mit starkem Tool Calling und sehr langem Kontext.

Zur offiziellen Modellseite

Bewertung im Detail

Gesamtnote aus drei gewichteten Dimensionen. Wie wir bewerten

Leistung (55 %) 68 %
DSGVO- und EU-Eignung (30 %) 90 %
Lizenz-Offenheit (15 %) 100 %

Fähigkeitsprofil

Wo IBM Granite 4.1 stark ist, über sechs Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 24 Modelle im Vergleich. Wie die Säulen entstehen

Coding 64* Mathe & Logik 62* Wissen 70* Deutsch 76* Agentik 82 Kontext 84*
IBM Granite 4.1 Median aller Modelle * redaktionelle Einschätzung (kein belegter Benchmark)
Fähigkeitsprofil von IBM Granite 4.1, Werte von 0 bis 100
SäuleWertGrundlage
Programmierung64redaktionelle Einschätzung
Mathematik & Logik62redaktionelle Einschätzung
Wissen70redaktionelle Einschätzung
Deutsch & Sprache76redaktionelle Einschätzung
Agentik & Werkzeuge82benchmarkbelegt
Langer Kontext84redaktionelle Einschätzung
Langer Kontext · Einschätzung 84
nutzbare Leistung über sehr lange Eingaben, nicht nur die Fenstergröße
Agentik & Werkzeuge 82
Werkzeuge selbständig aufrufen und mehrstufige Abläufe steuern
Deutsch & Sprache · Einschätzung 76
Sprachverständnis und Mehrsprachigkeit, mit Blick auf Deutsch
Wissen · Einschätzung 70
Fach- und Allgemeinwissen über viele Domänen hinweg
Programmierung · Einschätzung 64
Code schreiben und debuggen, ganze Repositories über viele Schritte bearbeiten
Mathematik & Logik · Einschätzung 62
mehrstufiges Rechnen und logisches Schließen mit prüfbarer Lösung

Stärkste Säule: Langer Kontext. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit „Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.

Steckbrief

Architektur
dicht
Parameter
8 Mrd. (dicht, alle aktiv)
Kontextfenster
512K Token8B und 30B bis 512K, 3B bis 128K.
Lizenz
Apache 2.0
Eingabe
Text (Vision und Speech als eigene Modelle)
Lokaler Betrieb
Eine GPU (8B ab 16 GB; 30B ~30 GB FP8)
Bei EU-Hostern
TeilweiseIBM watsonx in EU-Region (mit AVV), Self-Hosting

Angegeben ist das 8B-Hauptmodell. Die Familie reicht von 3B über 8B bis 30B, dazu Vision-, Speech- und Embedding-Modelle.

Benchmarks

Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.

68,3 BFCL-V3 (Tool Calling, 8B)
5,33 % OpenASR WER (Speech)
512K Token Kontextfenster

IBM Granite 4.1 ist eine der wenigen offenen Modellfamilien, die explizit auf den Unternehmenseinsatz zielt: vorhersagbare Antwortqualität, niedrige Betriebskosten und eine klare Apache-2.0-Lizenz. Die Familie umfasst dichte Sprachmodelle mit 3, 8 und 30 Milliarden Parametern, dazu ein Vision-Modell für Tabellen und Diagramme, Speech-Modelle für Transkription, Guardian-Modelle für Inhaltsfilter und mehrsprachige Embeddings. IBM verzichtet bewusst auf Mixture-of-Experts und setzt auf saubere Trainingsdaten. Das 8B-Instruct-Modell erreicht 68,3 im BFCL-V3-Benchmark für Tool Calling und übertrifft damit das eigene 32B-MoE aus Granite 4.0.

Das 8B- und das 30B-Modell verarbeiten bis zu 512.000 Token, das 3B-Modell bis 128.000. Das 3B läuft auf einem aktuellen Laptop, das 8B auf einer GPU mit 16 GB, das 30B mit FP8-Quantisierung auf rund 30 GB. Beim Self-Hosting bleiben alle Daten in der eigenen Infrastruktur, ohne Telemetrie zu IBM. Über IBM watsonx ist zusätzlich ein Betrieb in einer EU-Region mit Auftragsverarbeitungsvertrag möglich. Für Mittelstand und IT-Dienstleister mit Datenschutzanforderungen ist das eine konsistente, gut wartbare Grundlage.

Stärken

  • +Apache 2.0, klare Enterprise-Ausrichtung
  • +8B-Modell mit starkem Tool Calling, bis 512K Kontext
  • +Komplette Familie aus Sprache, Vision, Speech und Embeddings

Grenzen

  • Geringere Rohleistung als die großen Modelle
  • Nur 12 Sprachen offiziell, deutsche Qualität gut, nicht Spitzenklasse
  • Vision und Speech sind eigene Modelle, kein All-in-One

Quelle: IBM Granite-Doku (ibm.com/granite) und HF-Modellkarten, April 2026. Stand der Recherche: 17. Juli 2026. Die Prozent-Bewertung ist eine redaktionelle Einschätzung von gewusst:KI.

Lokale KI im eigenen Unternehmen aufbauen

Wir begleiten die Auswahl des passenden Modells, die Hardware-Planung und den Betrieb, lokal oder bei einem europäischen Hoster. Einen Einstieg bietet unser Workshop zu lokaler KI oder ein direktes Gespräch.