VI ▾
Lấy khóa API

Codex API: Chuyển đổi client của bạn trong ba dòng

Kết nối agent AI coding của bạn với một LLM không kiểm duyệt trong vài phút. Thay thế base URL và khóa API hiện tại của bạn để bắt đầu gửi yêu cầu đến một endpoint chuyên dụng, có thông lượng cao.

https://api.getcodexapi.com/v1uncensored

Base URL và Xác thực

API của chúng tôi tuân theo giao diện chat-completions chuẩn của OpenAI. Để tích hợp, hãy cập nhật cấu hình máy khách của bạn với địa chỉ URL cơ sở cụ thể của chúng tôi và một khóa codex api hợp lệ. Bạn tạo khóa này khi đăng ký trên bảng điều khiển. Endpoint chấp nhận cả yêu cầu tiêu chuẩn và truyền phát (streaming), giúp nó trở thành giải pháp thay thế trực tiếp cho hầu hết các tác nhân mã hóa chờ đợi cấu trúc tương thích OpenAI.

Xác thực dựa trên tiêu đề Authorization. Hãy bao gồm khóa của bạn dưới dạng mã thông báo Bearer. Nếu bạn đang sử dụng máy chủ trung gian hoặc khung tác nhân tùy chỉnh, hãy đảm bảo nó tuân thủ các tiêu đề HTTP tiêu chuẩn. Dịch vụ này độc lập; nó không định tuyến qua các nhà cung cấp khác hay tổng hợp các mô hình. Bạn đang kết nối trực tiếp với LLM không kiểm duyệt của chúng tôi.

Gửi Chat Completion

Hãy bắt đầu bằng cách kiểm tra một yêu cầu văn bản đơn giản. Điều này xác nhận rằng xác thực và địa chỉ URL cơ sở của bạn đều chính xác. Endpoint chấp nhận một danh sách các thông điệp với các vai trò như user hoặc assistant. ID mô hình luôn là uncensored. Yêu cầu này trả về phản hồi hoàn thành tiêu chuẩn. Hãy sử dụng điều này để xác minh rằng tác nhân của bạn có thể phân tích cấu trúc JSON trước khi chuyển sang các prompt phức tạp hơn.

Đảm bảo payload của bạn nằm trong giới hạn thân 8 MB. Các cửa sổ ngữ cảnh lớn được hỗ trợ, nhưng tổng số token (đầu vào cộng đầu ra) phải dưới 100.000 token. Nếu bạn vượt quá các giới hạn này, máy chủ sẽ trả về lỗi. Hãy bắt đầu với một bài kiểm tra nhỏ để xác minh kết nối.

curl https://api.getcodexapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Bật Streaming (SSE)

Đối với các agent mã hóa cần tạo token theo thời gian thực, hãy bật streaming. Đặt tham số stream thành true trong thân yêu cầu của bạn. Máy chủ trả về một chuỗi các Sự kiện do Máy chủ Gửi (SSE) thay vì một đối tượng JSON đơn lẻ. Mỗi sự kiện chứa một phần nhỏ của phản hồi. Điều này giảm độ trễ cảm nhận đối với người dùng của bạn và cho phép agent của bạn xử lý các token khi chúng đến.

Streaming không thay đổi giá hoặc đếm token. Bạn vẫn phải trả tiền cho tổng số token đầu vào và đầu ra. Xử lý luồng SSE trong mã client của bạn để tích lũy phản hồi cuối cùng hoặc xử lý nó theo từng bước. Điều này rất lý tưởng cho việc tạo mã nơi các kết quả trung gian hữu ích.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Sử dụng Tool Calling

Mô hình của chúng tôi hỗ trợ gọi hàm, cho phép agent của bạn thực thi các công cụ bên ngoài. Xác định các hàm của bạn trong tham số tools. Mô hình sẽ trả về phản hồi với một lệnh gọi công cụ thay vì văn bản thuần nếu nó xác định cần một hàm. Agent của bạn phải phân tích phản hồi này và thực thi công cụ, sau đó đưa kết quả trở lại cuộc trò chuyện.

Khả năng này rất quan trọng đối với các tác nhân mã hóa cần chạy mã, truy vấn cơ sở dữ liệu hoặc lấy dữ liệu trực tiếp. Lược đồ công cụ tuân theo định dạng chuẩn của OpenAI. Hãy đảm bảo tác nhân của bạn xử lý đúng vòng lặp giữa mô hình và logic thực thi công cụ của bạn. Điều này duy trì cửa sổ ngữ cảnh hiệu quả bằng cách thay thế văn bản thô bằng các kết quả công cụ có cấu trúc.

from openai import OpenAI

client = OpenAI(base_url="https://api.getcodexapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Kiểm tra các Mô hình Khả dụng

Hãy sử dụng endpoint GET /v1/models để xác minh các mô hình có sẵn. Endpoint này trả về một danh sách các đối tượng mô hình, bao gồm cả ID và ngày tạo của chúng. API của chúng tôi phục vụ một mô hình duy nhất: uncensored. Không giống như các máy chủ trung gian tổng hợp nhiều nhà cung cấp, chúng tôi cung cấp một endpoint chuyên dụng cho một LLM được tối ưu hóa. Điều này đảm bảo hành vi nhất quán và hiệu suất dự đoán được cho các nhiệm vụ mã hóa của bạn.

Truy vấn endpoint này để xác nhận máy khách của bạn đã kết nối với dịch vụ đúng. Nó trả về các trường siêu dữ liệu tiêu chuẩn. Bạn không cần quản lý việc chọn mô hình thủ công. Máy khách chỉ yêu cầu ID của mô hình uncensored trong tất cả các hoàn thành hội thoại. Điều này đơn giản hóa việc tích hợp và tránh các lỗi định tuyến.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.getcodexapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Giới hạn Tốc độ và Ràng buộc

Theo dõi mức sử dụng của bạn để tránh gián đoạn. API áp dụng giới hạn 300 yêu cầu mỗi phút mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi 429 Quá nhiều Yêu cầu. Kích thước thân yêu cầu được giới hạn ở 8 MB. Các ràng buộc này đảm bảo hiệu suất ổn định cho các agent có thông lượng cao. Điều chỉnh tần suất yêu cầu của client nếu bạn đang xử lý các lô lớn.

Lỗi xác thực trả về trạng thái 401 nếu khóa không hợp lệ. Tín dụng không đủ dẫn đến trạng thái 402. Hãy đảm bảo số dư trả trước của bạn dương trước khi gửi yêu cầu. Tín dụng không bao giờ hết hạn, vì vậy bạn có thể nạp tiền khi thuận tiện. Khóa codex api có thể được tạo lại bất cứ lúc nào, vô hiệu hóa khóa cũ ngay lập tức. Hãy giữ khóa của bạn an toàn.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.getcodexapi.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Chế độ JSONresponse_format: {"type": "json_object"}
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là dịch vụ chính thức của OpenAI không?

Không. Chúng tôi là một nhà cung cấp độc lập của một LLM không kiểm duyệt. API của chúng tôi tương thích với định dạng hoàn thành hội thoại của OpenAI, nhưng chúng tôi không sử dụng các mô hình GPT. Bạn phải cấu hình máy khách của mình để sử dụng địa chỉ URL cơ sở và ID mô hình của chúng tôi.

Điều gì xảy ra nếu tôi hết tín dụng?

Các yêu cầu sẽ thất bại với mã trạng thái 402. Tín dụng trả trước của bạn không hết hạn, vì vậy bạn có thể nạp tiền bất cứ lúc nào bằng crypto (USDT hoặc USDC). Không có phí đăng ký hàng tháng.

Bạn có cung cấp khả năng tạo hình ảnh hoặc âm thanh không?

Không. API này chỉ phục vụ văn bản. Nó hỗ trợ hoàn thành hội thoại với truyền phát (streaming) và gọi hàm. Nó không cung cấp khả năng embeddings, tạo hình ảnh, âm thanh hoặc video.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi địa chỉ URL cơ sở. Đó là toàn bộ quy trình thiết lập.

Lấy khóa API