IBM Granite 4.1
IBM · USA · veröffentlicht 29. April 2026
IBMs offene Modellfamilie für den Unternehmenseinsatz: dichte Modelle von 3B bis 30B, dazu Vision, Speech und Embeddings, alle unter Apache 2.0 mit starkem Tool Calling und sehr langem Kontext.
Zur offiziellen ModellseiteBewertung im Detail
Gesamtnote aus drei gewichteten Dimensionen. Wie wir bewerten
Fähigkeitsprofil
Wo IBM Granite 4.1 stark ist, über sechs Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 25 Modelle im Vergleich. Wie die Säulen entstehen
| Säule | Wert | Grundlage |
|---|---|---|
| Programmierung | 64 | redaktionelle Einschätzung |
| Mathematik & Logik | 62 | redaktionelle Einschätzung |
| Wissen | 70 | redaktionelle Einschätzung |
| Deutsch & Sprache | 76 | redaktionelle Einschätzung |
| Agentik & Werkzeuge | 82 | benchmarkbelegt |
| Langer Kontext | 84 | redaktionelle Einschätzung |
Stärkste Säule: Langer Kontext. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit „Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.
Steckbrief
- Architektur
- dicht
- Parameter
- 8 Mrd. (dicht, alle aktiv)
- Kontextfenster
- 512K Token8B und 30B bis 512K, 3B bis 128K.
- Lizenz
- Apache 2.0
- Eingabe
- Text (Vision und Speech als eigene Modelle)
- Lokaler Betrieb
- Eine GPU (8B ab 16 GB; 30B ~30 GB FP8)
- Bei EU-Hostern
- TeilweiseIBM watsonx in EU-Region (mit AVV), Self-Hosting
Angegeben ist das 8B-Hauptmodell. Die Familie reicht von 3B über 8B bis 30B, dazu Vision-, Speech- und Embedding-Modelle.
Benchmarks
Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.
IBM Granite 4.1 ist eine der wenigen offenen Modellfamilien, die explizit auf den Unternehmenseinsatz zielt: vorhersagbare Antwortqualität, niedrige Betriebskosten und eine klare Apache-2.0-Lizenz. Die Familie umfasst dichte Sprachmodelle mit 3, 8 und 30 Milliarden Parametern, dazu ein Vision-Modell für Tabellen und Diagramme, Speech-Modelle für Transkription, Guardian-Modelle für Inhaltsfilter und mehrsprachige Embeddings. IBM verzichtet bewusst auf Mixture-of-Experts und setzt auf saubere Trainingsdaten. Das 8B-Instruct-Modell erreicht 68,3 im BFCL-V3-Benchmark für Tool Calling und übertrifft damit das eigene 32B-MoE aus Granite 4.0.
Das 8B- und das 30B-Modell verarbeiten bis zu 512.000 Token, das 3B-Modell bis 128.000. Das 3B läuft auf einem aktuellen Laptop, das 8B auf einer GPU mit 16 GB, das 30B mit FP8-Quantisierung auf rund 30 GB. Beim Self-Hosting bleiben alle Daten in der eigenen Infrastruktur, ohne Telemetrie zu IBM. Über IBM watsonx ist zusätzlich ein Betrieb in einer EU-Region mit Auftragsverarbeitungsvertrag möglich. Für Mittelstand und IT-Dienstleister mit Datenschutzanforderungen ist das eine konsistente, gut wartbare Grundlage.
Stärken
- +Apache 2.0, klare Enterprise-Ausrichtung
- +8B-Modell mit starkem Tool Calling, bis 512K Kontext
- +Komplette Familie aus Sprache, Vision, Speech und Embeddings
Grenzen
- −Geringere Rohleistung als die großen Modelle
- −Nur 12 Sprachen offiziell, deutsche Qualität gut, nicht Spitzenklasse
- −Vision und Speech sind eigene Modelle, kein All-in-One
Quelle: IBM Granite-Doku (ibm.com/granite) und HF-Modellkarten, April 2026. Stand der Recherche: 23. Juli 2026. Die Prozent-Bewertung ist eine redaktionelle Einschätzung von gewusst:KI.
Lokale KI im eigenen Unternehmen aufbauen
Wir begleiten die Auswahl des passenden Modells, die Hardware-Planung und den Betrieb, lokal oder bei einem europäischen Hoster. Einen Einstieg bietet unser Workshop zu lokaler KI oder ein direktes Gespräch.