Was ist die Codex-API?
Der Begriff Codex API bezieht sich im Allgemeinen auf die Schnittstelle, die von KI-Modellen genutzt wird, die speziell für die Codegenerierung und das Codeverständnis trainiert wurden. Ursprünglich von OpenAI populär gemacht, hat sich dieses Konzept zu einem breiteren Standard entwickelt, bei dem verschiedene Anbieter OpenAI-kompatible Endpunkte anbieten. Für KI-Coding-Agents bedeutet dies eine konsistente POST /v1/chat/completions-Struktur, die Text-zu-Text-Interaktionen verarbeitet.
Unser Dienst bietet ein dediziertes, unzensiertes Large Language Model, das für Coding-Kontexte optimiert ist. Im Gegensatz zu Proxy-Relays, die mehrere Anbieter aggregieren, betreiben wir ein einzelnes Open-Weight-Modell auf unseren eigenen GPU-Servern. Dies gewährleistet einen stabilen Endpunkt mit einem einzelnen Modell und einem Kontextfenster mit 100.000 Token, was entscheidend ist, um große Codebasen zu verarbeiten, ohne den Kontext zu verlieren.
Die API unterstützt keine Embeddings, Bild-, Audio- oder Videogenerierung und bietet auch kein Fine-Tuning. Es handelt sich streng um eine textbasierte Completion-Engine, die direkt in Coding-Agents wie Cursor oder Claude Code integriert werden kann.
Warum ein unzensiertes Modell nutzen?
Standard-Coding-Modelle wenden oft Inhaltsfilter an, die technische Aufgaben beeinträchtigen können. Ein Modell könnte beispielsweise die Generierung von Code für eine Sicherheitslücke verweigern oder bestimmte Programmiersprachensyntax blockieren, wenn sie einem urheberrechtlich geschützten Werk ähnelt, auch wenn der Anwendungsfall rechtlich und technisch ist. Ein unzensiertes Modell entfernt diese willkürlichen Ablehnungen und ermöglicht es dem Agenten, sich rein auf die Codequalität und Logik zu konzentrieren.
Unser Modell ist darauf abgestimmt, bei der rechtmäßigen Nutzung für Erwachsene ohne Inhaltsablehnungen zu antworten. Das ist besonders nützlich für KI-Code-Agenten, die verschiedene Code-Snippets, Dokumentation oder kreative Coding-Projekte verarbeiten müssen, ohne auf einen 403 Forbidden-Fehler aufgrund der Inhaltsrichtlinie zu stoßen.
Es gibt eine harte Inhaltsgrenze, die immer gilt: keine sexuellen Inhalte mit Minderjährigen. Anfragen dieser Art werden blockiert. Für alle anderen rechtmäßigen, erwachsenen, fiktiven oder sicherheitsrelevanten Themen liefert das Modell eine direkte Antwort. Diese Stabilität reduziert den Bedarf an Retry-Logik im Workflow deines Agents und spart Token und Zeit.
Cursor IDE konfigurieren
Cursor IDE ist ein beliebter, KI-gestützter Code-Editor, der auf externen LLM-Endpunkten basiert. Um unsere unzensierte API als deinen primären Coding-Agent zu nutzen, musst du die Base URL in deinen Einstellungen aktualisieren.
Gehe zu deinen Cursor-Einstellungen und suche den API-Konfigurationsbereich. Ändere die Base URL in https://api.getcodexapi.com/v1. Gib deinen API-Schlüssel von der Seite API-Schlüssel erhalten ein. Die Modell-ID, die du auswählen solltest, ist uncensored.
Diese Konfiguration stellt sicher, dass alle Code-Vorschläge und -Bearbeitungen von unserem dedizierten Modell verarbeitet werden. Da Cursor das OpenAI-kompatible Format verwendet, ist keine zusätzliche Middleware erforderlich. Das Kontextfenster mit 100.000 Token ermöglicht es dem Editor, den Kontext über große Dateien oder Aufgaben zur Mehrdatei-Refaktorierung hinweg beizubehalten, was eine häufige Einschränkung bei Modellen mit kleinerem Kontext ist.
Abwägung: Du hast keinen Zugriff auf proprietäre Modelle wie GPT-4 oder Claude, es sei denn, du wechselst die Konfiguration manuell. Für reine Codegenerierung und -bearbeitung liefert dieser unzensierte Endpunkt jedoch oft schnellere und konsistentere Ergebnisse ohne Unterbrechungen durch Richtlinien.
Claude Code verbinden
Claude Code ist ein Befehlszeilen-Agent, der von Anthropic entwickelt wurde. Obwohl er typischerweise die API von Anthropic nutzt, kann er so konfiguriert werden, dass er jeden OpenAI-kompatiblen Endpunkt verwendet, wenn der Client dies unterstützt. Dies macht unsere API zu einer viablen Alternative für Nutzer, die das unzensierte Verhalten unseres Modells bevorzugen, aber die Claude Code-Oberfläche mögen.
Um dich zu verbinden, musst du sicherstellen, dass dein Client benutzerdefinierte Base URLs unterstützt. Aktualisiere die Konfiguration, um auf https://api.getcodexapi.com/v1 zu verweisen, und stelle das Modell auf uncensored. Du musst auch deinen API-Schlüssel angeben.
Diese Einrichtung ist nützlich für Entwickler, die die robusten Tool-Calling-Fähigkeiten eines Coding-Agents wünschen, aber ein Modell benötigen, das komplexe oder ungewöhnliche Code-Muster nicht ablehnt. Beachte, dass sich das Verhalten des zugrunde liegenden Modells trotz gleicher Schnittstelle von Standard-Claude-Modellen unterscheidet. Teste deine spezifischen Workflows immer, um sicherzustellen, dass das unzensierte Modell deine Codequalitätsstandards erfüllt.
OpenAI SDK nutzen
Das OpenAI SDK für Python oder Node.js ist darauf ausgelegt, mit jedem OpenAI-kompatiblen Endpunkt zu arbeiten. Du kannst unsere API nutzen, indem du die Base URL und den API-Schlüssel änderst.
So initialisierst du den Client in Python:
from openai import OpenAI
client = OpenAI(
base_url="https://api.getcodexapi.com/v1",
api_key="your-api-key"
)
Danach kannst du den Chat-Completion-Endpunkt wie üblich aufrufen:
response = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Write a Python function to sort a list."}]
)
Diese Einfachheit ermöglicht es dir, das zugrunde liegende Modell auszutauschen, ohne die Kernlogik deines Agents neu schreiben zu müssen. Das SDK übernimmt Serialisierung und Antwort-Parsing, sodass du dich auf die Anwendungslogik konzentrieren kannst.
Streaming-Antworten für Echtzeit-Feedback
Für Coding-Agents, die Echtzeit-Code-Vorschläge liefern, ist Streaming unerlässlich. Unsere API unterstützt Server-Sent Events (SSE) für Streaming-Antworten. Dies ermöglicht es dem Agenten, Code anzuzeigen, während er generiert wird, was die Benutzererfahrung verbessert.
- Stelle
stream=Truein deiner API-Anfrage ein. - Lese den Stream Chunk für Chunk.
- Aktualisiere die Benutzeroberfläche oder den Editor mit jedem Chunk.
Dies reduziert die wahrgenommene Latenz, insbesondere bei großen Codeblöcken. Da unser Modell ein Kontextfenster mit 100.000 Token hat, kannst du Antworten streamen, die große Mengen an Kontext enthalten, ohne dich um das Abschneiden (Truncation) sorgen zu müssen.
Hinweis: Streaming ändert weder die Preise noch die Token-Zählung. Tokens werden basierend auf der Gesamtmenge an Eingabe- und Ausgabe-Token abgerechnet, unabhängig davon, ob die Antwort gestreamt oder in einem einzigen Block zurückgegeben wird.
Verarbeitung von Function Calling
KI-Coding-Agents nutzen häufig Function Calling, um mit externen Tools zu interagieren, z. B. um einen Terminalbefehl auszuführen oder eine Datei zu lesen. Unsere API unterstützt dieses Feature und ermöglicht es dir, Funkschemas in deiner Anfrage zu definieren.
- Definiere deine Funktionen im Parameter
functions. - Das Modell gibt eine Antwort mit einem
function_call-Objekt zurück. - Dein Agent führt die Funktion aus und sendet das Ergebnis an das Modell zurück.
- Das Modell generiert die nächste Antwort basierend auf dem Ergebnis.
Diese mehrstufige Interaktion ist für komplexe Coding-Aufgaben entscheidend. Ein Agent muss beispielsweise eine Datei lesen, analysieren und anschließend eine Korrektur generieren. Unsere API verarbeitet dies nahtlos und behält den Kontext über mehrere Durchläufe hinweg innerhalb der 100.000-Token-Grenze bei.
Verwaltung von Ratenlimits
Um eine faire Nutzung und Stabilität zu gewährleisten, begrenzt unsere API die Nutzung auf 300 Anfragen pro Minute pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Wenn du diese Grenzen überschreitest, erhältst du einen 429 Too Many Requests-Fehler.
Best Practices:
- Implementiere exponentielles Backoff in der Retry-Logik deines Agents.
- Nutze Streaming, um die Anzahl der API-Aufrufe für große Antworten zu reduzieren.
- Überwache deine Nutzung über das Dashboard, um unerwartete Kosten zu vermeiden.
Wenn du Schlüssel rotieren möchtest, kannst du deinen API-Schlüssel jederzeit neu generieren. Dadurch wird der alte Schlüssel ungültig, also stelle sicher, dass du deine Agents aktualisierst, bevor du den Schlüssel neu generierst.