Zum Inhalt springen

Plattform-API — alle Modelle über eine Schnittstelle

GPT, Claude, Gemini, Llama und Mistral über eine einheitliche REST-API. Modell wechseln mit einem Parameter — DSGVO-konform auf europäischer Infrastruktur, Daten in Deutschland. Anbieterunabhängig.

Das Problem

Jedes Modell ein eigener Vertrag, ein eigenes SDK

Wer Modellanbieter direkt integriert, verhandelt für jeden einen Auftragsverarbeitungsvertrag, pflegt mehrere SDKs — und sitzt fest, wenn das beste Modell nächstes Quartal ein anderes ist.

Eine einheitliche API entkoppelt Ihre Anwendung vom Anbieter: Modellwechsel ist ein Parameter, kein Projekt — ein Vertrag, europäische Infrastruktur, Daten in Deutschland.

Schnellstart

In 3 Zeilen zur ersten Anfrage

OpenAI-kompatibel: Bestehender Code läuft nach dem Ändern der Base-URL sofort weiter — Migration in Minuten, kein Umbau.

Schnellstart
curl
curl https://apiv2.deutschlandgpt.de/platform-api/api/v2/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "messages": [
      {
        "role": "user",
        "content": "Your prompt here"
      }
    ],
    "model": "gemini-2.5-pro"
  }'
vorher.py · OpenAI (US)
python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    # Standard OpenAI Endpoint (US-Server)
)

response = client.chat.completions.create(
    model="gpt-4o",
    messages=[
        {"role": "user", "content": "Fasse zusammen."}
    ]
)
OpenAI SDK kompatibelPython, Node.js, Go, RESTSSE Streaming1 Zeile Code-Änderung, 0 Breaking Changes

Vorschau

Verbrauch, Schlüssel und Playgrounds an einem Ort

DeutschlandGPT API-Konsole: Nutzung nach Modell, API-Schlüssel, Protokolle und Playgrounds

Modelle

47 Modelle, 6 Anbieter — anbieterunabhängig

Wechseln Sie jederzeit das Modell. Kein Code-Umbau, keine neue Integration, keine Abhängigkeit.

Sprachmodelle

ModellAnbieterEingabe / 1MCache-Lesen / 1MCache-Schreiben / 1MAusgabe / 1MAPI-Parameter
Claude Haiku 4.5
Anthropic€ 1,65€ 0,17€ 2,07€ 8,25claude-4.5-haiku
Claude Opus 4.5
Anthropic€ 7,50€ 0,75€ 9,38€ 37,50claude-opus-4.5
Claude Opus 4.6
Anthropic€ 7,50€ 0,75€ 9,38€ 37,50claude-opus-4.6
Claude Opus 4.7
Anthropic€ 7,50€ 0,75€ 9,38€ 37,50claude-opus-4.7
Claude Opus 4.8
Anthropic€ 7,50€ 0,75€ 9,38€ 37,50claude-opus-4.8
Claude Opus 5
Anthropic€ 7,50€ 0,75€ 9,38€ 37,50claude-opus-5
Claude Sonnet 4
Anthropic€ 4,50€ 0,45€ 5,63€ 22,50claude-4-sonnet
Claude Sonnet 4.5
Anthropic€ 4,95€ 0,50€ 6,20€ 24,75claude-4.5-sonnet
Claude Sonnet 4.6
Anthropic€ 4,95€ 0,50€ 6,20€ 24,75claude-sonnet-4.6
Claude Sonnet 5
Anthropic€ 4,95€ 0,50€ 6,20€ 24,75claude-sonnet-5
Gemini 2.5 Flash
Google€ 0,45€ 0,05€ 0,45€ 3,75gemini-2.5-flash
Gemini 2.5 Pro
Google€ 1,88€ 0,18€ 1,88€ 15,00gemini-2.5-pro
Long-Context€ 3,75€ 0,38€ 3,75€ 22,50
Gemini 3.1 Flash-Lite
Google€ 0,38€ 0,05€ 0,38€ 2,25gemini-3.1-flash-lite
Gemini 3.5 Flash
Google€ 2,25€ 0,23€ 2,25€ 13,50gemini-3.5-flash
Gemini 3.6 Flash
Google€ 2,25€ 0,23€ 2,25€ 11,25gemini-3.6-flash
Gemini 3.7 Flash
Google€ 2,25€ 0,23€ 2,25€ 11,25gemini-3.7-flash
Llama 3.3 70b
Meta€ 6,09€ 6,09€ 6,09€ 6,09llama-3.3-70b
Devstral 2
Mistral AI€ 0,60€ 0,06€ 3,00devstral-2512
Magistral Small
Mistral AI€ 0,75€ 0,08€ 2,25magistral-small-2509
Ministral 3 8B
Mistral AI€ 0,23€ 0,03€ 0,23ministral-8b-3
Ministral 3B
Mistral AI€ 0,15€ 0,02€ 0,15ministral-3b-3
Mistral Large 3
Mistral AI€ 0,75€ 0,08€ 2,25mistral-large-latest
Mistral Small 4
Mistral AI€ 0,20€ 0,02€ 0,77mistral-small-latest
GPT-4.1
OpenAI€ 2,78€ 0,69€ 2,78€ 11,25gpt-4.1
GPT-4.1 Mini
OpenAI€ 0,54€ 0,15€ 0,54€ 2,22gpt-4.1-mini
GPT-4.1 Nano
OpenAI€ 0,15€ 0,05€ 0,15€ 0,54gpt-4.1-nano
GPT-4o
OpenAI€ 3,45€ 1,73€ 3,45€ 13,80gpt-4o
GPT-5
OpenAI€ 1,80€ 0,18€ 1,80€ 14,00gpt-5
GPT-5.1
OpenAI€ 1,80€ 0,18€ 1,80€ 14,00gpt-5.1
GPT-5.2
OpenAI€ 2,45€ 0,24€ 2,45€ 19,50gpt-5.2
GPT-5.4
OpenAI€ 3,50€ 0,36€ 3,50€ 21,00gpt-5.4
Long-Context€ 6,99€ 0,71€ 6,99€ 31,50
GPT-5.4 Mini
OpenAI€ 1,01€ 0,11€ 1,01€ 6,30gpt-5.4-mini
GPT-5.4 Nano
OpenAI€ 0,29€ 0,03€ 0,29€ 1,76gpt-5.4-nano
GPT-5.5
OpenAI€ 6,56€ 0,66€ 6,56€ 39,30gpt-5.5
Long-Context€ 16,50€ 1,65€ 16,50€ 74,25
GPT-5.6 LunaTop
OpenAI€ 0,33€ 0,03€ 0,42€ 1,98gpt-5.6-luna
Long-Context€ 0,66€ 0,08€ 0,84€ 3,00
GPT-5.6 Sol
OpenAI€ 8,25€ 0,83€ 10,32€ 49,50gpt-5.6-sol
Long-Context€ 16,50€ 1,65€ 20,63€ 74,25
GPT-5.6 TerraTop
OpenAI€ 3,30€ 0,33€ 4,13€ 19,80gpt-5.6-terra
Long-Context€ 6,60€ 0,66€ 8,25€ 29,70
o3
OpenAI€ 2,81€ 0,71€ 2,81€ 11,21o3
o3-mini
OpenAI€ 1,55€ 0,77€ 1,55€ 6,20o3-mini
o3-mini-high
OpenAI€ 1,55€ 0,77€ 1,55€ 6,20o3-mini-high
o4-mini
OpenAI€ 1,55€ 0,39€ 1,55€ 6,20o4-mini

Alle Preise netto pro 1 Mio. Tokens. Cache-Lesen gilt für Eingabe-Tokens, die aus dem Prompt-Cache wiederverwendet werden, Cache-Schreiben für das einmalige Ablegen im Cache. „—“ bedeutet: Das Modell unterstützt kein Prompt-Caching.

So funktioniert der Long-Context-Preis

Der Preis richtet sich nach der Größe der gesamten Anfrage. Überschreitet sie die Token-Grenze, wird sie vollständig — Eingabe und Ausgabe — zum höheren Preis abgerechnet. Er gilt dann für jedes Token, nicht nur für den Teil über der Grenze. Beispiel GPT-5.5:

272K
200K
Standard
300K
Long-Context

Die lange Anfrage ist komplett teurer — auch die ersten 272K Tokens, nicht nur die darüber.

Bildmodelle

ModellAnbieterPreisDimensionenAPI-Parameter
FLUX.2 [pro]Black Forest Labs€ 0,045 / Megapixel1024×1024, 1024×1792, 1792×1024flux-2-pro
Gemini 2.5 Flash (Image)Google€ 45,00 / 1M Output-Tokens1024×1024gemini-2.5-flash-image
ChatGPT Image LatestOpenAI€ 0,075 / Bild1024×1024chatgpt-image-latest
GPT Image 1OpenAI€ 0,063 / Bild1024×1024gpt-image-1
GPT Image 1.5OpenAI€ 0,075 / Bild1024×1024gpt-image-1.5
GPT Image 2OpenAI€ 0,0705 / Bild1024×1024gpt-image-2

Neue Modelle werden laufend hinzugefügt, ohne Änderung an Ihrer Integration.

Funktionen

Gebaut für Entwickler, abgesichert für Compliance

Alles, was Ihre Entwickler brauchen, ohne Kompromisse bei Datenschutz und Sicherheit.

Ein Parameter, alle Modelle

Wechseln Sie zwischen GPT, Claude, Gemini, Llama und Mistral durch Änderung des "model"-Parameters. Kein Umbau im Code notwendig.

DSGVO-konform ab Zeile 1

Jede API-Anfrage wird innerhalb der EU verarbeitet. Ihre Eingabedaten werden nicht gespeichert — nur die Nutzung wird bei uns protokolliert. Ihre Daten bleiben Ihre Daten.

Streaming & Async

Server-Sent Events für Echtzeit-Streaming. Asynchrone Batch-Verarbeitung für große Dokumentenmengen.

Multimodal in einer API

Text, Bildgenerierung, Audio-Transkription (STT), Text-to-Speech (TTS), Video und Embeddings — alles über dieselbe API, ohne separate Integrationen.

Prepaid Credits

API-Nutzung wird über prepaid Credits in EUR abgerechnet, unabhängig vom Chat-Abo. Mit Workspace-Limits, Auto-Topup, pro-Key-Budgets und Low-Balance-Warnungen.

OpenAI-kompatibel

Drop-in Replacement für die OpenAI API. Bestehenden Code migrieren — nur die Base-URL ändern.

Playgrounds

Erst testen, dann coden

Für jede API-Capability gibt es einen Browser-Playground: schnell ausprobieren, Modelle vergleichen, Prompts iterieren — ohne SDK-Setup. Was im Playground funktioniert, läuft 1:1 über die API.

Text Completion

Prompts und Modelle direkt im Browser testen. Modell wechseln, Parameter tunen, Antworten vergleichen — bevor Sie eine Zeile Code schreiben.

Bildgenerierung

GPT Image, DALL-E 3, Imagen 4, Gemini Flash Image und FLUX im Browser ausprobieren. Prompts iterieren, bevor Sie es in den Code übernehmen.

Embeddings

Vektor-Embeddings für Semantic Search, RAG und Klassifikation. Testen Sie Modelle und Dimensionen am echten Text aus Ihrer Domäne.

Audio-Transkription (STT)

Speech-to-Text-Modelle im Browser testen. Laden Sie Audio hoch, vergleichen Sie Sprach-Modelle und prüfen Sie Genauigkeit — ohne SDK.

Text-to-Speech (TTS)

Texte in natürliche Sprache umwandeln. Stimme, Sprache und Tempo wählen — direkt im Browser anhören, dann produktiv einsetzen.

Video-Generierung

Text-zu-Video-Modelle interaktiv testen. Prompts ausprobieren, Qualität prüfen und Auflösungen vergleichen — bevor Sie über die API rendern.

Abrechnung

Prepaid Credits, volle Kontrolle

API-Nutzung wird über prepaid Credits in EUR abgerechnet — unabhängig vom Chat-Abo. Sie laden Guthaben auf, definieren Limits und behalten jederzeit die Kostenkontrolle.

Hartes Spending-Limit: Credits sind ein verbindlicher Deckel — kein Überraschungs-Bill am Monatsende.

Workspace-Spending-Limits

Monatliche Obergrenzen pro Workspace. Verhindern Sie Überraschungen durch eine harte Deckelung — egal wer welche Schlüssel nutzt.

Auto-Topup

Automatisch aufladen, wenn das Guthaben unter eine Schwelle fällt. Keine Service-Unterbrechung während laufender Verarbeitung.

Pro-API-Key-Budgets

Jeder API-Key kann sein eigenes Monatslimit haben. Trennt Produktion sauber von Experimenten und einzelnen Teams.

Low-Balance & Limit-Warnungen

Automatische Benachrichtigungen, wenn das Guthaben knapp wird oder ein Workspace-Limit erreicht ist — bevor etwas ausfällt.

Workflow-Budgets

Eigene Budget-Caps für automatisierte Workflows. Automatisierungen können nie unkontrolliert Credits verbrauchen — selbst bei Schleifen oder Fehlern.

Unabhängig vom Chat-Abo

Credits sind getrennt vom Seat-basierten Chat-Lizenzmodell. Nur die tatsächliche API-Nutzung wird abgerechnet, nicht pro Nutzer.

Anwendungsfälle

Was Ihre Entwickler damit bauen können

Von Chatbots über Dokumenten-Automatisierung bis zur Datenanalyse: Die API ist das Fundament für eigene KI-Lösungen.

Eigene KI-Assistenten

Bauen Sie spezialisierte Chatbots und Assistenten für Ihre Fachabteilungen oder Ihre Kunden. DSGVO-konform mit Ihren Unternehmensdaten.

Dokumenten-Automation

Verträge analysieren, Berichte generieren und E-Mails klassifizieren. Automatisiert über die API in bestehende Systeme integriert.

Kundensupport-Integration

KI-gestützte Ticket-Klassifizierung, automatische Antwortvorschläge und Wissensdatenbank-Suche in Ihrem Helpdesk.

Datenanalyse & Reporting

Strukturierte Daten aus unstrukturierten Quellen extrahieren. JSON-Output für direkte Weiterverarbeitung in Ihren Systemen.

Sicherheit

Die API, die Ihr Datenschutzbeauftragter freigibt

Jede Anfrage läuft über europäische Infrastruktur, Daten in deutschen Rechenzentren. Vorbereitet für Audits, vorbereitet für Compliance.

Daten gespeichert in Deutschland

Jede API-Anfrage wird auf ISO 27001-zertifizierten Servern verarbeitet. Ihre Eingabedaten werden nicht gespeichert — nur die Nutzung wird protokolliert.

Außerhalb der US-Jurisdiktion

Kein US-Anbieter, kein CLOUD Act. Ihre Daten sind vor extraterritorialen Zugriffen geschützt.

ISO 27001, ISO 9001 & BSI C5 Hosting

ISO 27001- und ISO 9001-zertifiziert, Hosting auf BSI C5-zertifizierter Open Telekom Cloud.

Kein Modell-Training

Ihre Daten werden nie für das Training von KI-Modellen verwendet. Verarbeitung und Rückgabe, das ist alles.

FAQ

Was vor der Anbindung zu klären ist

Was ist die DeutschlandGPT API?
Eine einheitliche REST-API, über die sich alle führenden KI-Modelle (GPT, Claude, Gemini, Llama, Mistral) DSGVO-konform auf europäischer Infrastruktur — mit Datenspeicherung in Deutschland — nutzen lassen. Ein API-Key, ein einheitliches Interface.
Ist die API OpenAI-kompatibel?
Ja. Die DeutschlandGPT API ist ein Drop-in Replacement für die OpenAI API. Bestehender Code wird migriert, indem nur die Base-URL geändert wird. Alle gängigen SDKs (Python, Node.js, etc.) funktionieren sofort.
Wie wechsle ich zwischen KI-Modellen?
Durch Änderung des "model"-Parameters in der API-Anfrage. Der Rest des Codes bleibt identisch. Der Wechsel zwischen allen verfügbaren Modellen gelingt in Sekunden, ohne Code-Umbau und ohne neue Integration.
Unterstützt die API Streaming?
Ja. Server-Sent Events (SSE) für Echtzeit-Token-Streaming. Ideal für Chat-Interfaces und interaktive Anwendungen. Batch-Verarbeitung für große Dokumentenmengen ist ebenfalls verfügbar.
Gibt es SDKs und Client-Libraries?
Da unsere API OpenAI-kompatibel ist, lassen sich die offiziellen OpenAI SDKs für Python, Node.js, Go und weitere Sprachen verwenden. Zu ändern ist nur die Base-URL. Zusätzlich bieten wir eigene Beispiel-Projekte und Quickstart-Guides.
Wie sicher sind meine API-Anfragen?
Alle Anfragen werden über TLS 1.3 verschlüsselt. Daten werden ausschließlich auf ISO 27001-zertifizierten deutschen Servern der BSI C5-zertifizierten Open Telekom Cloud verarbeitet. Keine Daten werden für Modell-Training verwendet. Außerhalb der US-Jurisdiktion.

Eine API für alle Modelle

GPT, Claude, Gemini, Llama und Mistral — anbieterunabhängig, mit Daten in Deutschland.

4,8/5OMR Reviews

Kostenlos testen. Keine Kreditkarte nötig.

  • Für Sie & Ihr Team
  • Sofortiger Zugang
  • Völlig kostenlos