PL ▾
Pobierz klucz API

Jak korzystać z API OpenAI Codex dla agentów AI

API OpenAI Codex zapewnia standaryzowany interfejs dla agentów AI do generowania i edycji kodu, ale użycie alternatywy bez cenzury może wyeliminować niepotrzebne odmowy, które zakłócają zautomatyzowane przepływy pracy. Konfigurując swojego agenta tak, aby wskazywał na zgodny endpoint, możesz zachować tę samą strukturę zgodną z OpenAI, uzyskując bardziej przewidywalne odpowiedzi do złożonych lub kreatywnych zadań programistycznych.

Zaktualizowano

Kluczowe punkty

  • Endpoint LLM bez cenzury pozwala agentom kodowania przetwarzać tematy dla dorosłych lub kontrowersyjne bez blokowania legalnych żądań.
  • API obsługuje strumieniowanie za pomocą zdarzeń wysłanych przez serwer (SSE) oraz wywoływanie funkcji/narzędzi do złożonych interakcji agentów.
  • Cennik to model pay-as-you-go w cenie $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych bez opłat miesięcznych.
  • Możesz zintegrować usługę, aktualizując bazowy URL i klucz API w istniejących SDK zgodnych z OpenAI.

Czym jest API Codex?

Termin codex api odnosi się ogólnie do interfejsu używanego przez modele AI trenowane specjalnie do generowania i rozumienia kodu. Popularny pierwotnie dzięki OpenAI, koncept ten ewoluował w szerszy standard, w którym różni dostawcy oferują endpointy kompatybilne z OpenAI. Dla agentów programistycznych oznacza to spójną strukturę POST /v1/chat/completions obsługującą interakcje wejście tekstowe, wyjście tekstowe.

Nasza usługa zapewnia dedykowany, duży model językowy bez cenzury zoptymalizowany pod kątem kontekstów kodowania. W przeciwieństwie do proxy agregujących wielu dostawców, uruchamiamy pojedynczy model o otwartych wagach na naszych własnych serwerach GPU. Zapewnia to stabilny endpoint pojedynczego modelu z oknem kontekstu 100 000 tokenów, co jest kluczowe dla obsługi dużych baz kodu bez utraty kontekstu.

API nie obsługuje embeddingów, generowania obrazów, audio ani wideo, ani nie oferuje dostrajania (fine-tuning). Jest to ściśle silnik uzupełniania oparty na tekście, zaprojektowany do bezpośredniej integracji z agentami programistycznymi takimi jak Cursor lub Claude Code.

Dlaczego używać modelu bez cenzury?

Standardowe modele kodowania często stosują filtry treści, które mogą zakłócać zadania techniczne. Na przykład model może odmówić wygenerowania kodu dla exploitu bezpieczeństwa lub zablokować składnię konkretnego języka programowania, jeśli przypomina ona dzieło chronione prawem autorskim, nawet gdy przypadek użycia jest legalny i techniczny. Model bez cenzury usuwa te arbitralne odmowy, pozwalając agentowi skupić się wyłącznie na jakości i logice kodu.

Nasz model jest dostrojony do odpowiadania bez odmów treści dla użytku dorosłego w granicach prawa. Jest to szczególnie przydatne dla agentów programistycznych, które muszą przetwarzać zróżnicowane wycinki kodu, dokumentację lub projekty kreatywne bez napotykania błędu 403 Forbidden z powodu polityki treści.

Istnieje jeden twardy limit treści, który zawsze obowiązuje: brak treści seksualnych z udziałem małoletnich. Żądania tego typu są blokowane. Dla wszystkich innych legalnych tematów dla dorosłych, fikcyjnych lub badawczych dotyczących bezpieczeństwa, model udzieli bezpośredniej odpowiedzi. Ta stabilność zmniejsza potrzebę logiki ponawiania w przepływie pracy Twojego agenta, oszczędzając tokeny i czas.

Konfiguracja Cursor IDE

Cursor IDE to popularny edytor kodu wspierany przez AI, który opiera się na zewnętrznych endpointach LLM. Aby użyć naszego API bez cenzury jako głównego agenta kodowania, musisz zaktualizować bazowy URL w ustawieniach.

Przejdź do ustawień Cursor i znajdź sekcję konfiguracji API. Zmień bazowy URL na https://api.getcodexapi.com/v1. Wpisz swój klucz API ze strony Pobierz klucz API. ID modelu, który powinieneś wybrać, to uncensored.

Ta konfiguracja zapewnia, że wszystkie sugestie kodu i edycje są przetwarzane przez nasz dedykowany model. Ponieważ Cursor używa formatu zgodnego z OpenAI, nie jest wymagane dodatkowe middleware. Okno kontekstu 100 000 tokenów pozwala edytorowi utrzymać kontekst nad dużymi plikami lub zadaniami refaktoryzacji wieloplikowej, co jest powszechnym ograniczeniem w mniejszych modelach kontekstowych.

Kompromis: Nie będziesz miał dostępu do modeli własnościowych, takich jak GPT-4 czy Claude, chyba że ręcznie zmienisz konfigurację. Jednak w przypadku czystego generowania i edycji kodu ten endpoint bez cenzury często zapewnia szybsze i bardziej spójne wyniki bez przerw spowodowanych polityką.

Łączenie Claude Code

Claude Code to agent wiersza poleceń opracowany przez Anthropic. Choć zwykle korzysta z API Anthropic, może być skonfigurowany do używania dowolnego endpointu kompatybilnego z OpenAI, jeśli klient na to pozwala. Dzięki temu nasze API jest możliwą do zrealizowania alternatywą dla użytkowników, którzy preferują zachowanie bez cenzury naszego modelu, ale lubią interfejs Claude Code.

Aby się połączyć, musisz upewnić się, że Twój klient obsługuje niestandardowe bazowe URL. Zaktualizuj konfigurację, aby wskazywała na https://api.getcodexapi.com/v1 i ustaw model na uncensored. Będziesz również musiał podać swój klucz API.

Ta konfiguracja jest przydatna dla programistów, którzy chcą używać zaawansowanych możliwości wywoływania narzędzi agenta kodowania, ale potrzebują modelu, który nie odmawia złożonych lub nietypowych wzorców kodu. Pamiętaj, że choć interfejs pozostaje ten sam, zachowanie modelu w tle będzie się różnić od standardowych modeli Claude. Zawsze przetestuj swoje konkretne przepływy pracy, aby upewnić się, że model bez cenzury spełnia Twoje standardy jakości kodu.

Używanie SDK OpenAI

SDK OpenAI dla Pythona lub Node.js jest zaprojektowane do pracy z dowolnym endpointem zgodnym z OpenAI. Możesz przełączyć nasze API, zmieniając bazowy URL i klucz API.

Oto jak możesz zainicjować klienta w Pythonie:

from openai import OpenAI

client = OpenAI(

base_url="https://api.getcodexapi.com/v1",

api_key="your-api-key"

)

Następnie możesz wywołać endpoint uzupełnień czatu w zwykły sposób:

response = client.chat.completions.create(

model="uncensored",

messages=[{"role": "user", "content": "Write a Python function to sort a list."}]

)

Ta prostota pozwala na wymianę podstawowego modelu bez przepisywania logiki głównej Twojego agenta. SDK zajmuje się serializacją i parsowaniem odpowiedzi, więc możesz skupić się na logice aplikacji.

Strumieniowanie odpowiedzi w czasie rzeczywistym

Dla agentów programistycznych zapewniających sugestie kodu w czasie rzeczywistym strumieniowanie jest kluczowe. Nasze API obsługuje Eventy SSE (Server-Sent Events) do strumieniowania odpowiedzi. Pozwala to agentowi wyświetlać kod w miarę jego generowania, co poprawia doświadczenie użytkownika.

  • Ustaw stream=True w żądaniu API.
  • Czytaj strumień fragment po fragmencie.
  • Aktualizuj interfejs użytkownika lub edytor każdym fragmentem.

To zmniejsza postrzeganą opóźnienie, szczególnie dla dużych bloków kodu. Ponieważ nasz model ma okno kontekstu 100 000 tokenów, możesz strumieniować odpowiedzi zawierające duże ilości kontekstu bez obaw o ucięcie.

Uwaga: Strumieniowanie nie zmienia zasad rozliczeń ani liczenia tokenów. Tokeny są rozliczane na podstawie całkowitej ilości danych wejściowych i wyjściowych, niezależnie od tego, czy odpowiedź jest strumieniowana, czy zwracana w jednym bloku.

Obsługa wywoływania funkcji narzędzi

Agenci AI do programowania często korzystają z wywoływania funkcji do interakcji z zewnętrznymi narzędziami, np. uruchamiania polecenia w terminalu lub odczytu pliku. Nasze API obsługuje tę funkcję, pozwalając na zdefiniowanie schematów funkcji w zapytaniu.

  1. Zdefiniuj swoje funkcje w parametrze functions.
  2. Model zwróci odpowiedź z obiektem function_call.
  3. Twój agent wykonuje funkcję i wysyła wynik z powrotem do modelu.
  4. Model generuje kolejną odpowiedź na podstawie wyniku.

Ta interakcja wieloetapowa jest kluczowa dla złożonych zadań programistycznych. Na przykład agent może potrzebować przeczytania pliku, przeanalizowania go, a następnie wygenerowania poprawki. Nasze API obsługuje to bezproblemowo, zachowując kontekst w wielu turach w limicie 100 000 tokenów.

Zarządzanie limitami zapytań

Aby zapewnić uczciwe użytkowanie i stabilność, nasze API narzuca limit 300 zapytań na minutę na klucz. Maksymalny rozmiar ciała zapytania wynosi 8 MB. Jeśli przekroczysz te limity, otrzymasz błąd 429 Too Many Requests.

Najlepsze praktyki:

  • Zaimplementuj wykładnicze opóźnienie w logice ponawiania prób przez swojego agenta.
  • Używaj strumieniowania, aby zmniejszyć liczbę wywołań API dla dużych odpowiedzi.
  • Monitoruj swoje zużycie przez panel, aby uniknąć nieoczekiwanych opłat.

Jeśli musisz zmieniać klucze, możesz wygenerować ponownie swój klucz API w dowolnym momencie. Unieważnia to stary klucz, więc upewnij się, że zaktualizujesz swoich agentów przed ponownym wygenerowaniem.

Pytania i odpowiedzi

Czy to oficjalne API OpenAI Codex?

Nie, jest to niezależna usługa. Zapewniamy endpoint zgodny z OpenAI, uruchamiający dedykowany model bez cenzury na naszych własnych serwerach. Nie jest to model GPT, Claude, Gemini, Grok, DeepSeek ani żaden inny model dostawcy. Możesz korzystać z oficjalnych SDK OpenAI z naszym API, zmieniając bazowy URL.

Ile kosztuje API?

Ceny wynoszą $0,25 za 1 mln tokenów wejściowych i $1,00 za 1 mln tokenów wyjściowych. Nie ma miesięcznych opłat ani subskrypcji. Możesz doładować przedpłacony kredyt, zaczynając od $10, z bonusami za większe wpłaty.

Jaki jest rozmiar okna kontekstu?

Nasz model obsługuje okno kontekstu o rozmiarze 100 000 tokenów, które obejmuje zarówno prompt, jak i uzupełnienie. Jest to odpowiednie dla dużych baz kodu i złożonych zadań wieloplikowych.

Czy używacie promptów do trenowania?

Nie, Twoje prompty nie są używane do trenowania. Wymagamy tylko adresu e-mail i hasła do utworzenia konta, a nie zbieramy dodatkowych danych osobowych, takich jak numery telefonów.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.

Pobierz klucz API