DE ▾
API-Schlüssel erhalten

Codex API: Wechsle deinen Client in drei Zeilen

Verbinde dein KI-Coding-Agent mit einem unzensierten LLM in wenigen Minuten. Ersetze deine aktuelle Base URL und deinen API-Schlüssel, um Anfragen an einen dedizierten Endpunkt mit hoher Durchsatzleistung zu senden.

https://api.getcodexapi.com/v1uncensored

Base URL und Authentifizierung

Unsere API folgt der Standard-OpenAI-Chat-Completions-Schnittstelle. Aktualisiere zur Integration die Client-Konfiguration mit unserer Basis-URL und einem gültigen codex api-Schlüssel. Erzeuge diesen Schlüssel im Dashboard. Der Endpunkt akzeptiert Standard- und Streaming-Anfragen und ist ein sofort einsetzbarer Ersatz für die meisten Coding-Agents.

Die Authentifizierung basiert auf dem Authorization Header. Füge deinen Schlüssel als Bearer-Token ein. Wenn du einen Proxy oder ein benutzerdefiniertes Agent-Framework verwendest, stelle sicher, dass er Standard-HTTP-Header respektiert. Der Dienst ist unabhängig; er leitet Anfragen nicht über andere Anbieter weiter oder aggregiert Modelle. Du verbindest dich direkt mit unserem unzensierten LLM.

Chat-Vervollständigung senden

Beginne mit dem Testen einer einfachen Textanfrage. Dies bestätigt, dass deine Authentifizierung und Base URL korrekt sind. Der Endpunkt akzeptiert eine Liste von Nachrichten mit Rollen wie user oder assistant. Die Modell-ID ist immer uncensored. Diese Anfrage gibt eine Standard-Vervollständigungsantwort zurück. Verwende dies, um zu überprüfen, ob dein Agent die JSON-Struktur parsen kann, bevor du zu komplexeren Prompts übergehst.

Stelle sicher, dass dein Anfragetext die 8-MB-Grenze nicht überschreitet. Große Kontextfenster werden unterstützt, aber die Gesamtzahl der Token (Input plus Output) muss unter 100.000 Token bleiben. Wenn du diese Grenzen überschreitest, gibt der Server einen Fehler zurück. Beginne mit einem kleinen Test, um die Verbindung zu bestätigen.

curl https://api.getcodexapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming (SSE) aktivieren

Aktiviere für Coding-Agents, die Echtzeit-Token-Generierung benötigen, das Streaming. Setze den Parameter stream in deinem Anfragekörper auf true. Der Server gibt eine Sequenz von Server-Sent Events (SSE) zurück, anstatt eines einzelnen JSON-Objekts. Jedes Ereignis enthält einen Teil der Antwort. Dies reduziert die wahrgenommene Latenz für deine Benutzer und ermöglicht es deinem Agent, Token zu verarbeiten, sobald sie eintreffen.

Streaming ändert nicht die Preisgestaltung oder die Token-Zählung. Du zahlst weiterhin für die Gesamtzahl der Eingabe- und Ausgabetoken. Verarbeite den SSE-Stream in deinem Client-Code, um die endgültige Antwort zu akkumulieren oder inkrementell zu verarbeiten. Dies ist ideal für die Codegenerierung, bei der Zwischenergebnisse nützlich sind.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Function Calling verwenden

Unser Modell unterstützt Function Calling, wodurch dein Agent externe Tools ausführen kann. Definiere deine Funktionen im Parameter tools. Das Modell gibt eine Antwort mit einem Tool-Aufruf zurück, anstatt normalen Text, wenn es bestimmt, dass eine Funktion benötigt wird. Dein Agent muss diese Antwort parsen und das Tool ausführen, dann das Ergebnis zurück in den Konversationsverlauf einspeisen.

Diese Fähigkeit ist entscheidend für Coding-Agents, die Code ausführen, Datenbanken abfragen oder Live-Daten abrufen müssen. Das Tool-Schema folgt dem Standard-OpenAI-Format. Stelle sicher, dass dein Agent den Round-Trip zwischen dem Modell und deiner Tool-Ausführungslogik korrekt verarbeitet. Dies erhält das Kontextfenster effizient, indem roher Text durch strukturierte Tool-Ergebnisse ersetzt wird.

from openai import OpenAI

client = OpenAI(base_url="https://api.getcodexapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Verfügbare Modelle prüfen

Verwende den Endpunkt GET /v1/models, um die verfügbaren Modelle zu überprüfen. Dieser Endpunkt gibt eine Liste von Modellobjekten zurück, einschließlich ihrer IDs und Erstellungsdaten. Unsere API bedient ein einzelnes Modell: uncensored. Im Gegensatz zu Proxy-Relays, die mehrere Anbieter aggregieren, bieten wir einen dedizierten Endpunkt für ein optimiertes LLM. Dies gewährleistet konsistentes Verhalten und vorhersehbare Leistung für deine Coding-Aufgaben.

Führe eine Abfrage dieses Endpunkts durch, um zu bestätigen, dass dein Client mit dem richtigen Dienst verbunden ist. Er gibt Standard-Metadatenfelder zurück. Du musst die Modellauswahl nicht manuell verwalten. Der Client fordert einfach die Modell-ID uncensored in allen Chat-Vervollständigungen an. Dies vereinfacht die Integration und vermeidet Routing-Fehler.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.getcodexapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Ratenlimits und Einschränkungen

Überwache deine Nutzung, um Unterbrechungen zu vermeiden. Die API erzwingt ein Limit von 300 Anfragen pro Minute pro Schlüssel. Wenn du dieses überschreitest, erhältst du einen 429 Too Many Requests-Fehler. Die Größe des Anfragekörpers ist auf 8 MB begrenzt. Diese Einschränkungen gewährleisten eine stabile Leistung für Hochdurchsatz-Agents. Passe die Anfragehäufigkeit deines Clients an, wenn du große Batches verarbeitest.

Authentifizierungsfehler geben einen 401-Status zurück, wenn der Schlüssel ungültig ist. Unzureichendes Guthaben führt zu einem 402-Status. Stelle sicher, dass dein Prepaid-Guthaben positiv ist, bevor du Anfragen sendest. Guthaben verfallen nie, sodass du aufladen kannst, wenn es dir passt. Der codex api Schlüssel kann jederzeit neu generiert werden, wodurch der alte sofort widerrufen wird. Halte deinen Schlüssel sicher.

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.getcodexapi.com/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Bonus+5 % ab $50, +10 % ab $100
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ist dies ein offizieller OpenAI-Dienst?

Nein. Wir sind ein unabhängiger Anbieter eines unzensierten LLM. Unsere API ist mit dem OpenAI chat-completions-Format kompatibel, verwendet aber keine GPT-Modelle. Du musst deinen Client konfigurieren, um unsere Base URL und die Modell-ID zu verwenden.

Was passiert, wenn mein Guthaben aufgebraucht ist?

Anfragen schlagen mit dem Statuscode 402 fehl. Dein Prepaid-Guthaben verfällt nie, sodass du jederzeit per Krypto (USDT oder USDC) aufladen kannst. Es fallen keine monatlichen Abonnementgebühren an.

Bietest du Bild- oder Audio-Generierung an?

Nein. Diese API liefert nur Text. Sie unterstützt Chat-Vervollständigungen mit Streaming und Function Calling. Sie bietet keine Embeddings, Bildgenerierung, Audio- oder Video-Funktionen.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten