PT ▾
Obter chave de API

API Codex: Altere seu cliente em três linhas

Conecte seu agente de codificação AI a um LLM sem censura em minutos. Substitua sua URL base e chave de API atuais para começar a enviar requisições para um endpoint dedicado e de alta capacidade.

https://api.getcodexapi.com/v1uncensored

URL Base e Autenticação

Nossa API segue a interface padrão de chat-completions da OpenAI. Para integrar, atualize a configuração do seu cliente com nosso URL base específico e uma chave codex api válida. Você gera essa chave durante o cadastro no painel. O endpoint aceita requisições padrão e de streaming, tornando-o pronto para usar como substituição para a maioria dos agentes de codificação que esperam uma estrutura compatível com OpenAI.

A autenticação depende do cabeçalho Authorization. Inclua sua chave como token Bearer. Se você estiver usando um proxy ou um framework de agente personalizado, certifique-se de que ele respeite os cabeçalhos HTTP padrão. O serviço é independente; não passa por outros fornecedores ou agrega modelos. Você está se conectando diretamente ao nosso LLM sem censura.

Enviar Chat Completion

Comece testando uma solicitação de texto simples. Isso confirma que sua autenticação e URL base estão corretos. O endpoint aceita uma lista de mensagens com papéis como user ou assistant. O ID do modelo é sempre uncensored. Esta solicitação retorna uma resposta de conclusão padrão. Use isso para verificar se seu agente pode analisar a estrutura JSON antes de prosseguir para prompts complexos.

Certifique-se de que sua carga útil permaneça dentro do limite de corpo de 8 MB. Janelas de contexto grandes são suportadas, mas a contagem total de tokens (entrada mais saída) deve permanecer abaixo de 100.000 tokens. Se você exceder esses limites, o servidor retornará um erro. Comece com um teste pequeno para confirmar a conectividade.

curl https://api.getcodexapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Habilitar Streaming (SSE)

Para agentes de codificação que precisam de geração de tokens em tempo real, ative o streaming. Defina o parâmetro stream como true no corpo da sua solicitação. O servidor retorna uma sequência de Eventos Enviados pelo Servidor (SSE) em vez de um único objeto JSON. Cada evento contém um fragmento parcial da resposta. Isso reduz a latência percebida para seus usuários e permite que seu agente processe tokens conforme eles chegam.

O streaming não altera o preço ou a contagem de tokens. Você ainda paga pelos tokens totais de entrada e saída. Processe o fluxo SSE no código do seu cliente para acumular a resposta final ou processá-la incrementalmente. Isso é ideal para geração de código onde resultados intermediários são úteis.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Usar Tool Calling

Nosso modelo suporta chamada de funções, permitindo que seu agente execute ferramentas externas. Defina suas funções no parâmetro tools. O modelo retornará uma resposta com uma chamada de ferramenta em vez de texto simples se determinar que uma função é necessária. Seu agente deve analisar essa resposta e executar a ferramenta, em seguida, alimentar o resultado de volta na conversa.

Essa capacidade é essencial para agentes de codificação que precisam executar código, consultar bancos de dados ou buscar dados em tempo real. O esquema de ferramenta segue o formato padrão da OpenAI. Certifique-se de que seu agente lide corretamente com o ciclo entre o modelo e sua lógica de execução de ferramentas. Isso mantém a janela de contexto de forma eficiente, substituindo texto bruto por resultados de ferramentas estruturados.

from openai import OpenAI

client = OpenAI(base_url="https://api.getcodexapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Verificar Modelos Disponíveis

Use o endpoint GET /v1/models para verificar os modelos disponíveis. Este endpoint retorna uma lista de objetos de modelo, incluindo seus IDs e datas de criação. Nossa API serve um único modelo: uncensored. Diferente de relays de proxy que agregam vários fornecedores, fornecemos um endpoint dedicado para um LLM otimizado. Isso garante comportamento consistente e desempenho previsível para suas tarefas de codificação.

Consulte este endpoint para confirmar que seu cliente está conectado ao serviço correto. Ele retorna campos padrão de metadados. Você não precisa gerenciar a seleção de modelo manualmente. O cliente simplesmente solicita o ID do modelo uncensored em todas as conclusões de chat. Isso simplifica a integração e evita erros de roteamento.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.getcodexapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Limites de Requisição e Restrições

Monitore seu uso para evitar interrupções. A API impõe um limite de 300 requisições por minuto por chave. Se você exceder isso, receberá um erro 429 Too Many Requests. O tamanho do corpo da solicitação é limitado a 8 MB. Essas restrições garantem desempenho estável para agentes de alto throughput. Ajuste a frequência de solicitação do seu cliente se estiver processando grandes lotes.

Erros de autenticação retornam o status 401 se a chave for inválida. Créditos insuficientes resultam no status 402. Certifique-se de que seu saldo pré-pago seja positivo antes de enviar requisições. Os créditos não expiram, então você pode recarregar quando for conveniente. A chave codex api pode ser regenerada a qualquer momento, revogando a antiga instantaneamente. Mantenha sua chave segura.

Recursos e limites

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.getcodexapi.com/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Janela de contexto100.000 tokens (entrada + saída)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Modo JSONresponse_format: {"type": "json_object"}
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Bônus+5% a partir de $50, +10% a partir de $100
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Validadecrédito pago não expira, sem assinatura
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Este é um serviço oficial da OpenAI?

Não. Somos um provedor independente de um LLM sem censura. Nossa API é compatível com o formato de chat-completions da OpenAI, mas não usamos modelos GPT. Você deve configurar seu cliente para usar nossa URL base e ID do modelo.

O que acontece se eu ficar sem créditos?

As requisições falharão com código de status 402. Seu crédito pré-pago não expira, então você pode recarregar a qualquer momento usando cripto (USDT ou USDC). Não há taxa de assinatura mensal.

Vocês oferecem geração de imagem ou áudio?

Não. Esta API serve apenas texto. Suporta chat completions com streaming e chamada de funções. Não oferece embeddings, geração de imagem, áudio ou vídeo.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API