Zum Inhalt springen

Hosting & Cloud

IONOS AI Model Hub im Test

Der IONOS AI Model Hub ist die Inferenz-Plattform der IONOS Cloud GmbH, auf der fertige KI-Modelle als Dienst bereitstehen. Im Berliner Rechenzentrum laufen 8 Sprachmodelle, 1 Code-Modell, 2 Bildmodelle sowie Modelle für Texterkennung, Einbettungen und Rerank, alle über eine OpenAI-kompatible REST-API erreichbar. IONOS rechnet je Million Token ab, die Preise je Modell stehen in Euro auf der Produktseite.

4,0 von 5

Stand 3. August 2026

Preismodell Kostenpflichtig, Pro Million Token, 0,10 bis 0,65 Euro Eingabe und 0,15 bis 3,60 Euro Ausgabe, ohne Mindestabnahme
Betriebsort Cloud
DSGVO ohne weitere Auflagen einsetzbar
Quelloffen nein

Der AI Model Hub liefert fertige Modelle hinter einer Adresse, den Betrieb der Grafikkarten übernimmt IONOS. Wer bereits Code gegen die OpenAI-Schnittstelle geschrieben hat, muss nur Basis-Adresse und Schlüssel austauschen. Die eingebaute Vektor-Datenbank endet am 31. August 2026.

Wichtigste Funktionen

  • OpenAI-kompatible API: Die Schnittstelle folgt dem Format von OpenAI, deshalb läuft bestehender Code mit der OpenAI-Bibliothek weiter. Auch Tool Calling gehört dazu, also das Aufrufen eigener Funktionen durch das Modell. Nicht jedes Modell beherrscht es.
  • 8 Sprachmodelle in 3 Größenklassen: Die Liste reicht von Mistral Nemo (12B) und Llama 3.1 8B über Mistral Small 24B, Llama 3.3 70B und GPT-OSS 120B bis zu Llama 3.1 405B, das IONOS abgekündigt hat und am 15.09.2026 abschaltet. Am 14. und 22. Juli 2026 kamen Qwen3.5 397B A17B und Qwen3.5 9B dazu, auf das große Qwen verweist IONOS auch als Ersatz für das 405B-Modell. Beide verarbeiten Text und Bild bei einem Kontextfenster von 262.000 Token.
  • Code-Modell Qwen3 Coder Next 80B: Das Modell ersetzt seit Mai 2026 das abgeschaltete Code Llama 13B. Es erzeugt Code, sucht Fehler und arbeitet agentische Abläufe ab, also Aufgaben über mehrere Schritte hinweg. Das Kontextfenster liegt bei 128.000 Token, Tool Calling ist eingebaut.
  • Texterkennung und Bildgenerierung: LightOnOCR-2-1B liest Scans und Fotos aus und gibt fortlaufenden Text zurück, in mehreren Sprachen und mit Formelsatz. Das Modell nimmt allerdings nur Bilder an, PDFs musst du vorher umwandeln. Für Bilder aus Textbeschreibungen stehen FLUX.1-schnell und das neue FLUX.2-klein-4B bereit.
  • Einbettungen und Rerank: Vier Einbettungsmodelle erzeugen die Vektoren für semantische Suche, darunter das mehrsprachige BGE m3 und das für Text und Bild ausgelegte Qwen3 VL Embedding 8B. Qwen3 VL Reranker 8B sortiert die Treffer danach neu. Bei großen Dokumentbeständen landen dadurch die passenderen Stellen oben.
  • RAG über eine eigene Datenbank: Antworten aus den eigenen Dokumenten, kurz RAG, brauchten hier bisher keine zusätzliche Infrastruktur. Die eingebaute Vektor-Datenbank nimmt IONOS für neue Projekte nicht mehr an und schaltet sie am 31. August 2026 ganz ab. Vorgesehen ist stattdessen IONOS Managed PostgreSQL mit der Vektor-Erweiterung pgvector. Zum Umzug gibt es eine Anleitung, das nötige Neu-Einbetten berechnet IONOS bis zum Stichtag nicht.

Preise und Tarife

Die Preise stehen je Modell auf der deutschen Produktseite, in Euro und pro Million Token. Qwen3.5 9B kostet 0,10 Euro für die Eingabe und 0,15 Euro für die Ausgabe, Mistral Small 24B liegt bei 0,10 und 0,30 Euro, GPT-OSS 120B bei 0,15 und 0,65 Euro. Llama 3.3 70B verlangt 0,65 Euro in beide Richtungen, das Flaggschiff Qwen3.5 397B A17B 0,60 Euro für die Eingabe und 3,60 Euro für die Ausgabe.

Das Code-Modell Qwen3 Coder Next 80B kostet 0,15 und 0,80 Euro, die Texterkennung LightOnOCR 2 kommt auf 0,15 und 0,30 Euro. Einbettungen beginnen bei 0,01 Euro je Million Token, der Reranker liegt bei 0,04 Euro. Bilder rechnet IONOS anders ab, FLUX.1-schnell mit 0,0288 Euro je Bild, FLUX.2-klein mit 0,013 Euro für das erste und 0,001 Euro für jedes weitere Megapixel.

Eine Mindestabnahme gibt es nicht, eine Vertragslaufzeit ebenso wenig. Das Angebot richtet sich ausschließlich an Gewerbetreibende. IONOS weist alle genannten Beträge als Nettobeträge aus, die gesetzliche Umsatzsteuer kommt noch dazu.

Für wen ist der IONOS AI Model Hub geeignet?

  • Organisationen, die den Ort der Verarbeitung belegen müssen: Steuerkanzleien und kommunale Verwaltungen brauchen für ihr Verzeichnis der Verarbeitungstätigkeiten einen benannten Standort und einen Auftragsverarbeitungsvertrag. Beides liefert IONOS schriftlich, ohne dass du dafür ein Angebot anfragen musst.
  • Entwicklungsteams, die einen US-Anbieter ablösen: Wer eine Anwendung gegen die OpenAI-Schnittstelle gebaut hat, kommt mit 2 geänderten Zeilen aus. In n8n oder AnythingLLM trägst du IONOS als Anbieter ein.
  • Bestandskunden der IONOS Cloud: Server, Managed PostgreSQL und Modelle laufen unter einem Vertrag und auf einer Rechnung. Für RAG ist der Weg besonders kurz, weil du die Vektor-Erweiterung pgvector in der Managed-Datenbank nur einschaltest.

DSGVO und Datenschutz

Betreiber ist die IONOS Cloud GmbH. Die Produktdokumentation nennt Berlin als Standort der Infrastruktur und hält fest, dass die Verarbeitung auf Deutschland begrenzt bleibt.

Der Dienst arbeitet zustandslos, Eingaben und Antworten verwirft IONOS am Ende einer Sitzung. Für Betrieb und Fehlersuche fallen weiterhin normale Server-Protokolle an. Kundendaten fließen laut IONOS weder in das Training noch in das Nachtrainieren von Modellen.

Den Auftragsverarbeitungsvertrag kannst du vor dem Vertragsschluss lesen. Er steht in Version 7.4 im Volltext auf der Seite Datenschutzpaket, zusammen mit den technischen und organisatorischen Maßnahmen und der Liste der Unterauftragsverarbeiter.

Die ISO-27001-Zertifizierung nach IT-Grundschutz führt in ihrem Geltungsbereich Compute Engine, Object Storage und Managed Kubernetes auf, den AI Model Hub selbst nicht. Die Dokumentation spricht deshalb von zertifizierten Rechenzentren. Die C5-Testierung nach BSI vom 28. Mai 2026 umfasst 33 Dienste in 10 Gruppen. Welche das sind, veröffentlicht IONOS nicht.

Für die üblichen Anforderungen aus DSGVO und Auftragsverarbeitung reicht der Nachweisstand trotzdem. Standort und Vertragswerk sind schriftlich belegt und ohne Anmeldung nachlesbar.

Alternativen zum IONOS AI Model Hub

  • Infomaniak AI Services: Der Schweizer Anbieter betreibt Open-Source-Modelle in Genf und Zürich und spricht ebenfalls die OpenAI-Schnittstelle.
  • Mittwald: Mittwald richtet sein KI-Hosting an Agenturen aus und verwaltet es über das mStudio.
  • Hetzner: Hetzner ist günstiger, wenn du Modelle selbst auf GPU-Servern installierst. Das gibt dir mehr Kontrolle, kostet aber Konfigurationsaufwand.

Wofür IONOS AI Model Hub taugt

  • Verarbeitung im Berliner Rechenzentrum, Vertragspartner ist die IONOS Cloud GmbH
  • Auftragsverarbeitungsvertrag samt Maßnahmenliste und Unterauftragsverarbeitern schon vor Vertragsschluss lesbar
  • OpenAI-kompatible API, bestehender Code läuft nach dem Tausch von Adresse und Schlüssel weiter
  • Preise je Modell in Euro veröffentlicht, ohne Mindestabnahme und Vertragslaufzeit
  • Qwen3.5 397B A17B und Qwen3.5 9B seit Juli 2026 mit 262.000 Token Kontext

Wo es hakt

  • Eingebaute Vektor-Datenbank endet am 31. August 2026, RAG braucht danach eine eigene Datenbank
  • Kleineres Modellangebot als internationale Plattformen wie OpenRouter
  • Kein Zugang zu proprietären Modellen von OpenAI, Anthropic oder Google
  • Begrenzt auf 5 Anfragen je Sekunde, kurzzeitig 10

Wofür es eingesetzt wird

KI-API für eigene Anwendungen ohne Datentransfer in die USA · Semantische Suche mit Einbettungs- und Rerank-Modellen · Texterkennung aus Scans und Fotos · Bildgenerierung per API