
Alle Abfrageanfragen werden in europäischen Rechenzentren verarbeitet und unmittelbar danach gelöscht – Datenhoheit ist strukturell verankert und kein vertraglicher Zusatz.
Ihre Teams programmieren auf Basis einer stabilen REST-API, während IONOS CLOUD den gesamten Serving-Stack, die Modellversionierung und die Verfügbarkeit übernimmt.
Dank nativer, OpenAI-kompatibler REST-Endpunkte lassen sich bestehende Tools, SDKs und Frameworks ohne Anpassungen integrieren.
Kombinieren Sie große Sprachmodelle mit Ihren eigenen Dokumentensammlungen, um präzise, kontextbezogene und auf Ihren Daten basierende Antworten zu generieren.
Die Modelle liefern schema-gültiges JSON und strukturierte Tool-Aufrufe für Ihre Anwendung. So integrieren Sie nachgelagerte Systeme vollkommen nahtlos, direkt und absolut zuverlässig.
Sie zahlen nur für die Tokens, die Sie tatsächlich verbrauchen – keine Grundgebühren, kein Mindestumsatz und keine Kosten, wenn die Workloads im Leerlauf sind.


















Modell | Preis pro 1 Million Input-Token | Preis pro 1 Million Output-Token |
|---|---|---|
Qwen3.5-9B Neu | 0,10 € | 0,15 € |
Llama 3.1 8B Instruct | 0,15 € | 0,15 € |
Mistral Nemo Instruct | 0,15 € | 0,15 € |
Mistral Small 24B Instruct | 0,10 € | 0,30 € |
gpt-oss-120b | 0,15 € | 0,65 € |
Llama 3.3 70B Instruct | 0,65 € | 0,65 € |
Qwen3.5-397B-A17B Neu | 0,60 € | 3,60 € |
Qwen3.5-9B Neu | |
|---|---|
Modell | |
Preis pro 1 Million Input-Token | 0,10 € |
Preis pro 1 Million Output-Token | 0,15 € |
Llama 3.1 8B Instruct | |
Modell | |
Preis pro 1 Million Input-Token | 0,15 € |
Preis pro 1 Million Output-Token | 0,15 € |
Mistral Nemo Instruct | |
Modell | |
Preis pro 1 Million Input-Token | 0,15 € |
Preis pro 1 Million Output-Token | 0,15 € |
Mistral Small 24B Instruct | |
Modell | |
Preis pro 1 Million Input-Token | 0,10 € |
Preis pro 1 Million Output-Token | 0,30 € |
gpt-oss-120b | |
Modell | |
Preis pro 1 Million Input-Token | 0,15 € |
Preis pro 1 Million Output-Token | 0,65 € |
Llama 3.3 70B Instruct | |
Modell | |
Preis pro 1 Million Input-Token | 0,65 € |
Preis pro 1 Million Output-Token | 0,65 € |
Qwen3.5-397B-A17B Neu | |
Modell | |
Preis pro 1 Million Input-Token | 0,60 € |
Preis pro 1 Million Output-Token | 3,60 € |
Anwendungsfall
Entwickeln Sie interne oder bürgerorientierte Assistenten auf einer Inferenzebene, die die Datenschutzanforderungen strukturell erfüllt – ohne Ausnahmen und ohne Abstriche bei der Benutzerfreundlichkeit.
Anwendungsfall
Erstellen Sie RAG-Pipelines, mit denen Sie Ihr internes Dokumentenbestand erschließen können. IONOS CLOUD übernimmt die Einbettung und die LLM-Inferenz – Ihre Dokumente verlassen die Plattform zu keinem Zeitpunkt.
Anwendungsfall
Automatisieren Sie die Bearbeitung eingehender Verträge, Berichte und Korrespondenz. Strukturierte Extraktion relevanter Felder und direkte Übergabe an ERP- und DMS-Systeme ohne manuelle Zwischenschritte.