PT ▾
Obter chave de API

Como usar a API OpenAI Codex para Agentes de Codificação com IA

A API OpenAI Codex fornece uma interface padronizada para agentes de código de IA gerarem e editarem código, mas usar uma alternativa sem censura pode eliminar recusas desnecessárias que interrompem fluxos de trabalho automatizados. Ao configurar seu agente para apontar para um endpoint compatível, você pode manter a mesma estrutura compatível com OpenAI enquanto obtém respostas mais previsíveis para tarefas de codificação complexas ou criativas.

Atualizado

Pontos principais

  • Um endpoint de LLM sem censura permite que agentes de codificação processem tópicos adultos ou controversos sem bloquear solicitações legítimas.
  • A API suporta streaming via Server-Sent Events (SSE) e chamada de funções/ferramentas para interações complexas de agentes.
  • O preço é pagamento por uso a US$ 0,25 por 1M de tokens de entrada e US$ 1,00 por 1M de tokens de saída, sem taxas mensais.
  • Você pode integrar o serviço atualizando a URL base e a chave de API em seus SDKs compatíveis com OpenAI existentes.

O que é a API Codex?

O termo codex api geralmente se refere à interface usada por modelos de IA treinados especificamente para geração e compreensão de código. Originalmente popularizado pela OpenAI, esse conceito evoluiu para um padrão mais amplo onde vários provedores oferecem endpoints compatíveis com OpenAI. Para agentes de código de IA, isso significa uma estrutura consistente POST /v1/chat/completions que lida com interações texto-entrada, texto-saída.

Nosso serviço fornece um modelo de linguagem grande dedicado e sem censura, otimizado para contextos de codificação. Diferente de proxies que agregam vários fornecedores, executamos um único modelo de pesos abertos em nossos próprios servidores GPU. Isso garante um endpoint estável de modelo único com uma janela de contexto de 100.000 tokens, o que é crítico para lidar com grandes bases de código sem perder o contexto.

A API não suporta embeddings, geração de imagens, áudio ou vídeo, nem oferece ajuste fino. É estritamente um mecanismo de conclusão baseado em texto projetado para se integrar diretamente a agentes de codificação como Cursor ou Claude Code.

Por que usar um modelo sem censura?

Modelos de codificação padrão frequentemente aplicam filtros de conteúdo que podem interferir em tarefas técnicas. Por exemplo, um modelo pode recusar gerar código para uma exploração de segurança ou bloquear sintaxe específica de uma linguagem de programação se se assemelhar a uma obra protegida por direitos autorais, mesmo quando o caso de uso é legítimo e técnico. Um modelo sem censura remove essas recusas arbitrárias, permitindo que o agente se concentre puramente na qualidade e na lógica do código.

Nosso modelo é ajustado para responder sem recusas de conteúdo para uso adulto lícito. Isso é particularmente útil para agentes de código de IA que precisam processar trechos de código diversos, documentação ou projetos de codificação criativa sem encontrar um erro 403 Forbidden devido à política de conteúdo.

Há um limite de conteúdo rígido que sempre se aplica: sem conteúdo sexual envolvendo menores. Solicitações desse tipo são bloqueadas. Para todos os outros tópicos adultos legítimos, fictícios ou de pesquisa de segurança, o modelo fornecerá uma resposta direta. Essa estabilidade reduz a necessidade de lógica de nova tentativa no fluxo de trabalho do seu agente, economizando tokens e tempo.

Configurando o Cursor IDE

O Cursor IDE é um editor de código popular com IA que depende de endpoints de LLM externos. Para usar nossa API sem censura como seu agente de codificação principal, você precisa atualizar a URL base nas configurações.

Vá para as configurações do Cursor e localize a seção de configuração da API. Altere a URL base para https://api.getcodexapi.com/v1. Insira sua chave de API da página Obter chave de API. O ID do modelo que você deve selecionar é uncensored.

Esta configuração garante que todas as sugestões e edições de código sejam processadas pelo nosso modelo dedicado. Como o Cursor usa o formato compatível com OpenAI, nenhum middleware adicional é necessário. A janela de contexto de 100.000 tokens permite que o editor mantenha o contexto em arquivos grandes ou tarefas de refatoração com vários arquivos, o que é uma limitação comum em modelos de contexto menor.

Compromisso: Você não terá acesso a modelos proprietários como GPT-4 ou Claude, a menos que altere as configurações manualmente. No entanto, para geração e edição puramente de código, este endpoint sem censura geralmente fornece resultados mais rápidos e consistentes sem interrupções de política.

Conectando o Claude Code

Claude Code é um agente de linha de comando desenvolvido pela Anthropic. Embora normalmente use a API da Anthropic, ele pode ser configurado para usar qualquer endpoint compatível com OpenAI se o cliente suportar. Isso torna nossa API uma alternativa viável para usuários que preferem o comportamento sem censura do nosso modelo, mas gostam da interface do Claude Code.

Para conectar, você precisa garantir que seu cliente suporte URLs base personalizadas. Atualize a configuração para apontar para https://api.getcodexapi.com/v1 e defina o modelo para uncensored. Você também precisará fornecer sua chave de API.

Esta configuração é útil para desenvolvedores que desejam as capacidades robustas de chamada de ferramentas de um agente de codificação, mas precisam de um modelo que não recuse padrões de código complexos ou incomuns. Observe que, embora a interface permaneça a mesma, o comportamento do modelo subjacente diferirá dos modelos Claude padrão. Sempre teste seus fluxos de trabalho específicos para garantir que o modelo sem censura atenda aos seus padrões de qualidade de código.

Usando o SDK OpenAI

O SDK OpenAI para Python ou Node.js é projetado para funcionar com qualquer endpoint compatível com OpenAI. Você pode usar nossa API alterando a URL base e a chave de API.

Veja como você pode inicializar o cliente em Python:

from openai import OpenAI

client = OpenAI(

base_url="https://api.getcodexapi.com/v1",

api_key="your-api-key"

)

Em seguida, você pode chamar o endpoint de conclusões de chat como de costume:

response = client.chat.completions.create(

model="uncensored",

messages=[{"role": "user", "content": "Write a Python function to sort a list."}]

)

Essa simplicidade permite que você substitua o modelo subjacente sem reescrever a lógica central do seu agente. O SDK lida com serialização e análise de respostas, para que você possa se concentrar na lógica da aplicação.

Respostas em streaming para feedback em tempo real

Para agentes de codificação que fornecem sugestões de código em tempo real, o streaming é essencial. Nossa API suporta Server-Sent Events (SSE) para respostas em streaming. Isso permite que o agente exiba o código conforme ele está sendo gerado, melhorando a experiência do usuário.

  • Defina stream=True em sua solicitação de API.
  • Leia o fluxo chunk por chunk.
  • Atualize a interface do usuário ou o editor com cada chunk.

Isso reduz a latência percebida, especialmente para blocos grandes de código. Como nosso modelo tem uma janela de contexto de 100.000 tokens, você pode transmitir respostas que incluem grandes quantidades de contexto sem se preocupar com truncamento.

Nota: O streaming não altera o preço nem a contagem de tokens. Os tokens são cobrados com base no total de entrada e saída, independentemente de a resposta ser transmitida ou retornada em um único bloco.

Gerenciamento de chamadas de funções

Agentes de codificação com IA frequentemente usam chamada de funções para interagir com ferramentas externas, como executar um comando no terminal ou ler um arquivo. Nossa API suporta esse recurso, permitindo que você defina esquemas de funções na sua requisição.

  1. Defina suas funções no parâmetro functions.
  2. O modelo retornará uma resposta com um objeto function_call.
  3. Seu agente executa a função e envia o resultado de volta ao modelo.
  4. O modelo gera a próxima resposta com base no resultado.

Essa interação em múltiplas rodadas é crucial para tarefas de codificação complexas. Por exemplo, um agente pode precisar ler um arquivo, analisá-lo e depois gerar uma correção. Nossa API lida com isso de forma transparente, mantendo o contexto em várias rodadas dentro do limite de 100.000 tokens.

Gerenciamento de limites de requisições

Para garantir uso justo e estabilidade, nossa API impõe um limite de 300 requisições por minuto por chave. O tamanho máximo do corpo da requisição é de 8 MB. Se você exceder esses limites, receberá um erro 429 Too Many Requests.

Melhores práticas:

  • Implemente backoff exponencial na lógica de retry do seu agente.
  • Use streaming para reduzir o número de chamadas de API para respostas grandes.
  • Monitore seu uso pelo painel para evitar cobranças inesperadas.

Se precisar rotacionar chaves, você pode regenerar sua chave de API a qualquer momento. Isso revoga a chave antiga, então certifique-se de atualizar seus agentes antes de regenerar.

Perguntas e respostas

Esta é a API oficial do OpenAI Codex?

Não, este é um serviço independente. Fornecemos um endpoint compatível com OpenAI executando um modelo sem censura dedicado em nossos próprios servidores. Não é GPT, Claude, Gemini, Grok, DeepSeek ou qualquer modelo de outro fornecedor. Você pode usar os SDKs oficiais da OpenAI com nossa API alterando a URL base.

Quanto custa a API?

O preço é $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Não há mensalidades ou assinaturas. Você pode recarregar com crédito pré-pago a partir de $10, com bônus para depósitos maiores.

Qual é o tamanho da janela de contexto?

Nosso modelo suporta uma janela de contexto de 100.000 tokens, que inclui tanto o prompt quanto a conclusão. Isso é adequado para grandes bases de código e tarefas complexas com múltiplos arquivos.

Você usa prompts para treinamento?

Não, seus prompts não são usados para treinamento. Apenas solicitamos um e-mail e senha para criar uma conta, e não coletamos dados pessoais adicionais como números de telefone.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API