Что такое API Codex?
Термин codex api обычно относится к интерфейсу, используемому ИИ-моделями, обученными специально для генерации и понимания кода. Изначально популяризированный OpenAI, этот концепт эволюционировал в более широкий стандарт, где различные провайдеры предлагают совместимые с OpenAI эндпоинты. Для ИИ-моделей, работающих с кодом, это означает согласованную структуру POST /v1/chat/completions, которая обрабатывает взаимодействие «текст на вход — текст на выход».
Наш сервис предоставляет выделенную нецензурируемую большую языковую модель, оптимизированную для контекста кода. В отличие от прокси-ретрансляторов, агрегирующих несколько поставщиков, мы запускаем единственную модель с открытыми весами на наших собственных GPU-серверах. Это обеспечивает стабильный эндпоинт с одной моделью и контекстным окном на 100 000 токенов, что критично для обработки больших кодовых баз без потери контекста.
API не поддерживает эмбеддинги, генерацию изображений, аудио или видео, а также тонкую настройку. Это строго текстовый движок завершения, предназначенный для прямой интеграции в ИИ-агентов, таких как Cursor или Claude Code.
Почему использовать нецензурируемую модель?
Стандартные модели кода часто применяют фильтры контента, которые могут мешать техническим задачам. Например, модель может отказать в генерации кода для эксплойта безопасности или заблокировать синтаксис конкретного языка программирования, если он напоминает авторское произведение, даже если случай использования законный и технический. Нецензурируемая модель устраняет эти произвольные отказы, позволяя агенту сосредоточиться исключительно на качестве и логике кода.
Наша модель настроена на ответы без отказов по контенту для законного использования взрослыми. Это особенно полезно для ИИ-агентов по коду, которым нужно обрабатывать разнообразные фрагменты кода, документацию или креативные проекты кода, не сталкиваясь с ошибкой 403 Forbidden из-за политики контента.
Существует одно жесткое ограничение по контенту, которое всегда применяется: отсутствие сексуального контента с участием несовершеннолетних. Запросы такого типа блокируются. Для всех остальных законных тем для взрослых, художественных или исследовательских тем в области безопасности модель предоставит прямой ответ. Эта стабильность снижает необходимость в логике повторных попыток в рабочем процессе вашего агента, экономя токены и время.
Настройка Cursor IDE
Cursor IDE — популярный редактор кода с поддержкой ИИ, который опирается на внешние эндпоинты LLM. Чтобы использовать наше нецензурируемое API в качестве основного ИИ-агента по коду, вам нужно обновить базовый URL в настройках.
Перейдите в настройки Cursor и найдите раздел конфигурации API. Измените базовый URL на https://api.getcodexapi.com/v1. Введите ваш API-ключ со страницы Получить API-ключ. Идентификатор модели, который вы должны выбрать, — uncensored.
Эта конфигурация гарантирует, что все предложения по коду и правки обрабатываются нашей выделенной моделью. Поскольку Cursor использует формат, совместимый с OpenAI, дополнительное промежуточное ПО не требуется. Контекстное окно на 100 000 токенов позволяет редактору поддерживать контекст в больших файлах или задачах по рефакторингу нескольких файлов, что является распространенным ограничением моделей с меньшим контекстом.
Компромисс: У вас не будет доступа к проприетарным моделям, таким как GPT-4 или Claude, если вы не переключите конфигурацию вручную. Однако для чистой генерации и редактирования кода этот нецензурируемый эндпоинт часто обеспечивает более быстрые и последовательные результаты без прерываний политикой.
Подключение Claude Code
Claude Code — это CLI-агент, разработанный Anthropic. Хотя обычно он использует API Anthropic, его можно настроить на использование любого эндпоинта, совместимого с OpenAI, если клиент поддерживает это. Это делает наш API жизнеспособной альтернативой для пользователей, которые предпочитают поведение без цензуры нашей модели, но любят интерфейс Claude Code.
Для подключения вам нужно убедиться, что ваш клиент поддерживает пользовательские базовые URL. Обновите конфигурацию, указав https://api.getcodexapi.com/v1, и установите модель на uncensored. Вам также нужно будет предоставить ваш API-ключ.
Эта настройка полезна для разработчиков, которым нужны возможности вызова функций кодингового агента, но требуется модель, которая не отказывается от сложных или необычных шаблонов кода. Обратите внимание, что, хотя интерфейс остается прежним, поведение базовой модели будет отличаться от стандартных моделей Claude. Всегда тестируйте ваши конкретные рабочие процессы, чтобы убедиться, что модель без цензуры соответствует вашим стандартам качества кода.
Использование SDK OpenAI
SDK OpenAI для Python или Node.js предназначен для работы с любым эндпоинтом, совместимым с OpenAI. Вы можете переключиться на наше API, изменив базовый URL и API-ключ.
Вот как вы можете инициализировать клиент в Python:
from openai import OpenAI
client = OpenAI(
base_url="https://api.getcodexapi.com/v1",
api_key="your-api-key"
)
Затем вы можете вызвать эндпоинт для создания завершений чата как обычно:
response = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Write a Python function to sort a list."}]
)
Эта простота позволяет вам заменять лежащую в основе модель без переписывания основной логики вашего агента. SDK обрабатывает сериализацию и парсинг ответов, так что вы можете сосредоточиться на логике приложения.
Потоковая передача ответов для обратной связи в реальном времени
Для ИИ-агентов, предоставляющих предложения по коду в реальном времени, потоковая передача необходима. Наш API поддерживает Server-Sent Events (SSE) для потоковой передачи ответов. Это позволяет агенту отображать код по мере его генерации, улучшая пользовательский опыт.
- Установите
stream=Trueв вашем API-запросе. - Читайте поток по частям.
- Обновляйте интерфейс или редактор с каждой частью.
Это снижает воспринимаемую задержку, особенно для больших блоков кода. Поскольку наша модель имеет контекстное окно на 100 000 токенов, вы можете потоково передавать ответы, включающие большие объемы контекста, не беспокоясь об усечении.
Примечание: Потоковая передача не меняет тарификацию или подсчет токенов. Токены тарифицируются на основе общего объема входных и выходных данных, независимо от того, передается ли ответ потоком или возвращается одним блоком.
Обработка вызовов функций
AI-агенты для разработки кода часто используют вызов функций для взаимодействия с внешними инструментами, например для выполнения команд в терминале или чтения файлов. Наш API поддерживает эту возможность, позволяя определять схемы функций в вашем запросе.
- Определите ваши функции в параметре
functions. - Модель вернёт ответ с объектом
function_call. - Ваш агент выполняет функцию и отправляет результат обратно модели.
- Модель генерирует следующий ответ на основе полученного результата.
Это многошаговое взаимодействие критически важно для сложных задач разработки кода. Например, агенту может потребоваться прочитать файл, проанализировать его, а затем сгенерировать исправление. Наш API обрабатывает это бесшовно, сохраняя контекст в течение нескольких шагов в пределах лимита в 100 000 токенов.
Управление лимитами запросов
Для обеспечения справедливого использования и стабильности наш API устанавливает лимит 300 запросов в минуту на один ключ. Максимальный размер тела запроса составляет 8 МБ. Если вы превысите эти лимиты, вы получите ошибку 429 Too Many Requests.
Лучшие практики:
- Реализуйте экспоненциальное замедление в логике повторных попыток вашего агента.
- Используйте потоковую передачу, чтобы уменьшить количество вызовов API для больших ответов.
- Отслеживайте использование через панель управления, чтобы избежать неожиданных расходов.
Если вам нужно сменить ключи, вы можете сгенерировать новый API-ключ в любое время. Это аннулирует старый ключ, поэтому убедитесь, что вы обновили свои агенты перед генерацией нового ключа.