AI-API-Relay

AI-API-Relay, erklärt

Was ein Relay tut, wie man eines beurteilt und wie unseres funktioniert.

Ein AI-API-Relay leitet Ihre Anfragen an Upstream-Modellanbieter weiter und gibt die Antwort zurück — ein Endpunkt, ein Schlüssel, eine Rechnung über mehrere Anbieter. Diese Seite erklärt, was das in der Praxis bedeutet und woran sich ein zuverlässiges Relay von einem fragilen unterscheidet.

Ein Schlüssel für mehrere AnbieterRouting nach GesundheitszustandÖffentliches StatusboardKostenprotokolle je Anfrage

Was ist ein AI-API-Relay?

Ein Relay sitzt zwischen Ihrem Client und den Upstream-Anbietern. Sie senden eine Anfrage im OpenAI- oder Anthropic-Stil, das Relay wählt einen gesunden Kanal, leitet weiter und streamt die Antwort zurück. Ihr Code behält das bestehende SDK; geändert werden nur Base URL und Schlüssel.

Woran erkennt man ein zuverlässiges Relay

Vier Dinge zählen mehr als der Preis. Veröffentlicht es den Live-Kanalstatus statt Vertrauen zu verlangen? Schaltet es automatisch um, wenn ein Upstream nachlässt? Protokolliert es Token und Kosten je Anfrage, damit die Rechnung prüfbar ist? Und akzeptiert es die nativen Formate /v1/responses und /v1/messages, statt alles in Chat Completions zu zwingen?

Was dieses Gateway bietet

Claude Code, Codex, GPT, Gemini und Grok hinter einem Endpunkt, mit öffentlichem Gruppenstatus, automatischem Failover innerhalb einer Gruppe, Nutzungsprotokollen zu Modell, Token und Kosten sowie Tarifen nach Tag, Woche oder Monat.

Q

Worin unterscheiden sich AI-API-Relay und Proxy?

In der Praxis beschreiben sie dasselbe: einen Dienst, der Modell-API-Anfragen weiterleitet und die Antwort zurückgibt. Ein Relay ergänzt reines Forwarding meist um Schlüsselverwaltung, Kontingente, Abrechnung und Routing.

Q

Muss ich Code ändern, um ein Relay zu nutzen?

Meist nur Base URL und API-Key. Die meisten OpenAI- und Anthropic-SDKs sowie Tools wie Claude Code und die Codex-CLI funktionieren danach unverändert.

Q

Wie prüfe ich, ob ein Relay wirklich stabil ist?

Prüfen Sie, ob es ein Live-Statusboard je Kanalgruppe veröffentlicht, Failover dokumentiert und ob Nutzungsprotokolle jede Anfrage mit dem berechneten Betrag abstimmen lassen.

Q

Welche Modelle erreiche ich mit einem Schlüssel?

Claude und Claude Code, OpenAI Codex und GPT, Google Gemini sowie xAI Grok — alles über einen Schlüssel und Endpunkt, Umschalten per Modellname je Anfrage.

Eine API, viele Optionen

Gateway ausprobieren