Eine kontrollierte API für mehrere KI-Modelle

Verwenden Sie OpenAI- und Anthropic-kompatible Clients für Chat, Responses und Embeddings. Modell-Allowlist, Ausgabenbudget und Verbrauch werden pro externem API-Schlüssel verwaltet.

API-Zugriff mit Authentifizierung, Budgets und vorhandenen API-Schlüsseln

Mit vorhandenem OpenAI- oder Anthropic-Client starten

OpenAI-kompatibel · cURL
curl "https://ai-zentrale.ihr-unternehmen.de/v1/chat/completions" \
  -H "Authorization: Bearer $AI_ZENTRALE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Hallo"}]
  }'
Anthropic-kompatibel · Python
import os
from anthropic import Anthropic

client = Anthropic(
    api_key=os.environ["AI_ZENTRALE_API_KEY"],
    base_url="https://ai-zentrale.ihr-unternehmen.de",
)

message = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=512,
    messages=[{"role": "user", "content": "Hallo"}],
)

Endpunkte und Grenzen vor der Client-Umstellung prüfen

Beide Pfade verwenden externe API-Schlüssel der AI Zentrale. Der aufgerufene Endpunkt bestimmt Anfrageformat und Header; Modell-Allowlist und Budget gelten pro Schlüssel.

Horizontal wischen, um OpenAI- und Anthropic-kompatible Pfade zu vergleichen →

Endpunkte und Grenzen vor der Client-Umstellung prüfen
PrüffeldOpenAI-kompatibelAnthropic-kompatibel
Endpunkte

/v1/models, /v1/chat/completions, /v1/responses und /v1/embeddings.

/v1/messages und /v1/messages/count_tokens.

Authentifizierung

Externer API-Schlüssel im Header Authorization: Bearer.

Externer API-Schlüssel im Header x-api-key.

Streaming

Bei einem Streaming-Aufruf wird die laufende Ausgabe als Server-Sent Events übertragen.

Bei einem Streaming-Aufruf wird die laufende Ausgabe als Server-Sent Events übertragen.

Embeddings

Über den eigenen OpenAI-kompatiblen Endpunkt /v1/embeddings.

Kein eigener Embeddings-Endpunkt im Anthropic-kompatiblen Pfad.

Limits

Modell-Allowlist und separates Ausgabenbudget des verwendeten Schlüssels.

Modell-Allowlist und separates Ausgabenbudget des verwendeten Schlüssels.

Modelle und Budget am einzelnen API-Schlüssel prüfen

Die Detailansicht ergänzt die Schlüsselübersicht im Hero und macht die konkrete Modell-Allowlist sowie das separate Budget sichtbar.

Dialog für einen API-Schlüssel mit Modellfreigaben und Budget

Modelle und Budget pro Schlüssel begrenzen

Jeder API-Schlüssel erhält eine eigene Modell-Allowlist und ein separates Budget.

Vom einmaligen Geheimniswert bis zum widerrufenen Zugang

Ein kompatibler Client verkürzt die technische Umstellung. Der Schlüssel braucht trotzdem eine eigene Begrenzung, einen getesteten Fehlerpfad und einen klaren Widerruf.

  1. 01
    Schlüssel anlegen

    Erstellen Sie einen externen API-Schlüssel und übernehmen Sie den Geheimniswert einmalig in den vorgesehenen Secret Store.

  2. 02
    Modelle und Budget begrenzen

    Erlauben Sie nur die benötigten Modelle und setzen Sie ein separates Ausgabenlimit für Anwendung oder Umgebung.

  3. 03
    Client konfigurieren

    Stellen Sie Basis-URL und Authentifizierungsheader im vorhandenen OpenAI- oder Anthropic-kompatiblen Client um.

  4. 04
    Antwort und Fehler testen

    Prüfen Sie einen erfolgreichen Aufruf sowie ein nicht erlaubtes Modell und ein überschrittenes Budget in der Testumgebung.

  5. 05
    Verbrauch prüfen und sperren

    Ordnen Sie Nutzung und Kosten dem Schlüssel zu und widerrufen Sie ihn, sobald Anwendung oder Zugang nicht mehr benötigt werden.

Zugriff und Kosten pro Anwendung begrenzen

Die Verwaltungsansicht im Produktbeleg und diese vier Kontrollen gehören zusammen: eigener Schlüssel, Modell-Allowlist, Budget und zuordenbarer Verbrauch.

  • Getrennter externer Schlüssel

    API-Zugänge werden unabhängig von der persönlichen Chat-Anmeldung verwaltet und können einzeln widerrufen werden.

  • Modell-Allowlist pro Schlüssel

    Ein Schlüssel erhält nur Zugriff auf die ausdrücklich ausgewählten Modelle, nicht automatisch auf alle Organisationsmodelle.

  • Eigenes Ausgabenbudget

    Das Limit des Schlüssels wird getrennt vom Chat-Budget der Organisation geführt und begrenzt den vorgesehenen Einsatz.

  • Verbrauch pro Schlüssel

    Nutzung und Kosten bleiben dem jeweiligen API-Zugang zugeordnet, damit auffällige oder veraltete Zugänge erkennbar sind.

Häufig gestellte Fragen

Testen Sie einen kompatiblen Client mit realistischen Grenzen.

Bringen Sie Client, benötigte Endpunkte, Modelle, Budgetrahmen und einen erwarteten Berechtigungsfehler mit in die technische Produktdemo.