OVHcloud AI Endpoints: KI-Tool Test & Bewertung
OVHcloud ist ein französischer Cloud-Anbieter mit 46 eigenen Rechenzentren und 1,6 Millionen Kunden. Die AI Endpoints stellen 19 Modelle mit offenen Gewichten über eine OpenAI-kompatible Schnittstelle bereit, die Rechenarbeit läuft im Rechenzentrum Gravelines. Der Preis richtet sich nach den verbrauchten Token, ohne Mindestabnahme und ohne Vertragslaufzeit. Rohleistung gibt es im selben Konto als GPU-Instanz.
Zuletzt aktualisiert: 4. August 2026
Zwei französische Anbieter kommen in die engere Wahl, wenn eine KI-Schnittstelle nachweisbar in Europa rechnen soll. OVHcloud ist der größere davon, ein börsennotierter Konzern aus Roubaix, der seine Server selbst baut und in eigenen Rechenzentren betreibt. Die Inferenz der AI Endpoints läuft an genau einem Ort, im nordfranzösischen Gravelines, und diesen Ort können Sie nicht wechseln.
Wichtigste Funktionen
- OpenAI-kompatible API: Bestehender Code mit der OpenAI-Bibliothek läuft nach dem Tausch von Adresse und Schlüssel weiter. Der Wechsel von einem US-Dienst kostet keinen Umbau der Anwendung.
- 19 Modelle mit offenen Gewichten: Im Katalog stehen gpt-oss-20b und gpt-oss-120b für Aufgaben mit Zwischenschritten, Qwen3.6-27B und das große Qwen3.5-397B-A17B mit 262.000 Token Kontext und Bildverständnis, dazu Meta-Llama-3.3-70B und Qwen2.5-VL-72B. Proprietäre Modelle wie GPT-5 oder Claude gibt es hier nicht.
- Sprache, Bilder und Moderation: Whisper transkribiert Audio, 4 Riva-Stimmen sprechen Text ein, darunter eine deutsche. Stable Diffusion XL erzeugt Bilder, 2 Qwen3Guard-Modelle prüfen Ein- und Ausgaben auf unerwünschte Inhalte.
- Batch-Schnittstelle für Massenläufe: Bis zu 50.000 Zeilen je Auftrag laufen im Hintergrund durch, das Ergebnis liegt nach spätestens 24 Stunden vor. Während der Beta-Phase ist das kostenfrei, zur allgemeinen Freigabe soll die Hälfte des Basispreises fällig werden. Für die Klassifizierung ganzer Dokumentenbestände oder das Aufbereiten einer Wissensbasis für die Suche ist das der günstige Weg.
- GPU-Instanzen zum Selbstbetrieb: Für konstante Last oder ein eigenes Modell buchen Sie im selben Konto Instanzen mit H100, A100, L40S oder L4. Gravelines hat die größte Auswahl, die H200 steht zusätzlich in Paris.
- Freier Zugang ohne Anmeldung: Der Testbereich (Playground) auf der Katalogseite beantwortet 2 Anfragen pro Minute je IP-Adresse und Modell, ganz ohne Schlüssel. Mit Schlüssel sind es 400 Anfragen pro Minute je Projekt und Modell.
Preise und Tarife
OVHcloud rechnet pro Million Token ab. gpt-oss-20b liegt bei 0,04 Euro für die Eingabe und 0,15 Euro für die Ausgabe, gpt-oss-120b bei 0,08 und 0,40 Euro. Qwen3.6-27B kostet 0,40 und 2,70 Euro, Qwen3.5-397B-A17B 0,60 und 3,60 Euro, Meta-Llama-3.3-70B einheitlich 0,67 Euro in beide Richtungen.
Embeddings, also die für die Suche berechneten Zahlenwerte eines Textes, beginnen bei 0,01 Euro pro Million Token. Whisper rechnet nach Sekunden ab, die schnelle Fassung mit 0,00001278 Euro je Sekunde. Sprachausgabe, Bildgenerierung und die beiden Moderationsmodelle kosten nichts, der anonyme Zugang mit 2 Anfragen pro Minute bleibt dauerhaft frei. Für das erste Public-Cloud-Projekt gibt es 200 Euro Guthaben, gültig für 1 Monat.
Für den Selbstbetrieb zählt der Stundenpreis je GPU, unabhängig von der Tokenzahl. Eine H100 mit 80 GB startet bei 2,80 Euro pro Stunde, eine A100 bei 2,75 Euro, eine L40S bei 1,40 Euro. OVHcloud zählt sekundengenau ab einer Mindestdauer von 1 Minute, und eine angehaltene Instanz kostet weiter, solange sie nicht gelöscht ist.
Für die H200-Instanz mit 8 Karten nennt die Preisliste keinen Betrag, den erfragen Sie beim Vertrieb. Der Selbstbetrieb rechnet sich bei gleichmäßig hoher Auslastung oder wenn ein nachtrainiertes Modell laufen soll.
Alle genannten Beträge sind Nettopreise, die Umsatzsteuer kommt hinzu. Die deutsche Preisliste zeigt in der Voreinstellung den Bruttowert mit 19 %. Die Zahlen dort sehen deshalb zunächst höher aus als hier.
Für wen ist OVHcloud geeignet?
- Unternehmen mit strenger Datenschutzprüfung: Wer der eigenen Datenschutzbeauftragten belegen muss, wo OVHcloud rechnet und mit wem der Vertrag zustande kommt, bekommt hier einen deutschen Vertragspartner, einen frei abrufbaren Auftragsverarbeitungsvertrag und ein benanntes Rechenzentrum in Frankreich.
- Teams, die von OpenAI wegwollen: Die kompatible Schnittstelle macht die Umstellung bestehender Anwendungen einfach. In n8n oder AnythingLLM tragen Sie nur eine neue Adresse und einen neuen Schlüssel ein.
- Projekte mit großen Stapelläufen: Ein ganzer Dokumentenbestand, der klassifiziert oder für die Suche aufbereitet werden soll, läuft über die Batch-Schnittstelle, in der laufenden Beta-Phase ohne Kosten und nach der allgemeinen Freigabe zur Hälfte des Basispreises. Die Wartezeit von bis zu 24 Stunden nehmen Sie dafür in Kauf.
DSGVO und Datenschutz
Für deutsche Kunden ist die OVH GmbH in Köln der Vertragspartner, eine Tochter der französischen OVH Groupe SA ohne US-Muttergesellschaft. Den Auftragsverarbeitungsvertrag laden Sie ohne Anmeldung herunter, die deutsche Fassung trägt das Datum 17.10.2025 und steht auf ovhcloud.com unter den Vertragsbedingungen.
Daneben liegt eine Liste der Unterauftragsverarbeiter vom 16.10.2025. Sie führt auch Konzerngesellschaften in Kanada, Großbritannien, Indien, Australien und Singapur auf, die für Betrieb und Wartung eingreifen können. Für solche Zugriffe gelten die von der EU-Kommission vorgegebenen Standardvertragsklauseln nach Artikel 44 ff. DSGVO.
Die Inferenz selbst läuft ausschließlich in Gravelines. Das steht in der Produktdokumentation vom 03.02.2026, und die Verfügbarkeitstabelle nach Regionen bestätigt es, dort trägt AI Endpoints allein unter Frankreich einen Haken. OVHcloud sichert zu, übermittelte Inhalte weder zum Training der Modelle zu nutzen noch über die Abrechnung hinaus aufzubewahren.
Die zugrunde liegende Public-Cloud-Plattform ist nach ISO 27001, 27017, 27018 und 27701 zertifiziert, für französische Gesundheitsdaten kommt die HDS-Zulassung hinzu. Die staatliche französische Sicherheitsqualifizierung SecNumCloud gilt bei OVHcloud nur für die Hosted Private Cloud, nicht für die AI Endpoints.
Die Sonderbedingungen, die die Dokumentation für AI Endpoints verlinkt, heißen bis heute "Specific conditions for testing phase" und stammen vom 11.07.2024. Darin schließt OVHcloud jede Zusage zu Stabilität, Sicherheit und Verfügbarkeit aus und behält sich vor, den Dienst nach der Testphase nicht weiterzuführen, während die Produktseite mit einer Verfügbarkeitszusage wirbt. Diese Unstimmigkeit sollten Sie vor dem Vertragsschluss klären. Rechenort, Rechtsträger und Vertragswerk können Sie bei OVHcloud trotzdem einzeln nachlesen, und alle drei liegen in Europa.
Alternativen zu OVHcloud
- Scaleway: Auch Scaleway kommt aus Frankreich und verbindet Token-API mit eigenen GPU-Servern. Die Bedienung ist etwas schlanker, das Datenschutzprofil ähnlich. Für den direkten Vergleich ist das die naheliegende zweite Adresse.
- IONOS AI Model Hub: IONOS betreibt die Server in Deutschland, hat ein BSI-C5-Testat und bringt eine Vektor-Datenbank für Antworten aus eigenen Dokumenten mit.
- Hetzner: Günstiger, wenn Sie Modelle selbst auf GPU-Servern installieren und betreiben möchten. Sie behalten mehr Kontrolle und richten dafür alles selbst ein.
Vorteile
- Inferenz ausschließlich in Gravelines, Vertragspartner für deutsche Kunden ist die OVH GmbH in Köln
- Auftragsverarbeitungsvertrag frei herunterladbar, dazu eine öffentliche Liste der Unterauftragsverarbeiter
- OVHcloud nutzt Eingaben nach eigener Zusage nicht zum Training und speichert außer den Abrechnungsdaten nichts
- Dauerhaft freier Zugang ohne Schlüssel, 200 Euro Startguthaben für das erste Public-Cloud-Projekt
- Token-API und eigene GPU-Instanzen im selben Konto, Preise in Euro ausgewiesen
Nachteile
- Der Katalog ist auf 19 Modelle geschrumpft, Modelle von Mistral und DeepSeek fehlen
- Qwen3-32B, Mistral-7B-Instruct-v0.3 und Qwen3-Coder-30B werden bis zum 01.10.2026 abgeschaltet
- Die Sonderbedingungen für AI Endpoints stehen weiterhin unter dem Titel Testphase, Fassung vom 11.07.2024
- Kein Zugang zu proprietären Modellen wie GPT-5 oder Claude
- Starke inhaltliche Nähe zu Scaleway, ebenfalls ein französischer Anbieter mit Token-API und GPU