Apa itu API Codex?
Istilah codex api umumnya merujuk pada antarmuka yang digunakan oleh model AI yang dilatih khusus untuk generasi dan pemahaman kode. Awalnya dipopulerkan oleh OpenAI, konsep ini telah berkembang menjadi standar yang lebih luas di mana berbagai penyedia menawarkan endpoint yang kompatibel dengan OpenAI. Untuk agen pemrograman AI, ini berarti struktur POST /v1/chat/completions yang konsisten yang menangani interaksi teks masuk dan teks keluar.
Layanan kami menyediakan model bahasa besar tanpa sensor khusus yang dioptimalkan untuk konteks pemrograman. Tidak seperti relai proksi yang mengagregasi beberapa vendor, kami menjalankan satu model bobot terbuka di server GPU kami sendiri. Ini memastikan endpoint model tunggal yang stabil dengan jendela konteks 100.000 token, yang sangat penting untuk menangani basis kode besar tanpa kehilangan konteks.
API tidak mendukung embedding, gambar, audio, atau generasi video, dan juga tidak menawarkan fine-tuning. Ini secara ketat merupakan mesin kelengkapan berbasis teks yang dirancang untuk berintegrasi langsung ke dalam agen pemrograman seperti Cursor atau Claude Code.
Mengapa Menggunakan Model Tanpa Sensor?
Model pemrograman standar sering menerapkan filter konten yang dapat mengganggu tugas teknis. Misalnya, model mungkin menolak untuk menghasilkan kode untuk eksploitasi keamanan atau memblokir sintaks bahasa pemrograman tertentu jika menyerupai karya yang dilindungi hak cipta, meskipun kasus penggunaannya sah dan teknis. Model tanpa sensor menghilangkan penolakan sewenang-wenang ini, memungkinkan agen fokus murni pada kualitas dan logika kode.
Model kami disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah. Ini sangat berguna untuk agen pemrograman AI yang perlu memproses cuplikan kode, dokumentasi, atau proyek pemrograman kreatif yang beragam tanpa mencapai kesalahan 403 Forbidden karena kebijakan konten.
Ada satu batas konten keras yang selalu berlaku: tidak ada konten seksual yang melibatkan anak di bawah umur. Permintaan jenis itu diblokir. Untuk semua topik dewasa yang sah, fiksi, atau penelitian keamanan lainnya, model akan memberikan jawaban langsung. Stabilitas ini mengurangi kebutuhan untuk logika percobaan ulang dalam alur kerja agen Anda, menghemat token dan waktu.
Mengonfigurasi IDE Cursor
IDE Cursor adalah editor kode berbasis AI populer yang bergantung pada endpoint LLM eksternal. Untuk menggunakan API tanpa sensor kami sebagai agen pemrograman utama Anda, Anda perlu memperbarui URL dasar di pengaturan Anda.
Buka pengaturan Cursor Anda dan temukan bagian konfigurasi API. Ubah URL dasar menjadi https://api.getcodexapi.com/v1. Masukkan kunci API Anda dari halaman Dapatkan kunci API. ID model yang harus Anda pilih adalah uncensored.
Konfigurasi ini memastikan bahwa semua saran dan edit kode diproses oleh model khusus kami. Karena Cursor menggunakan format yang kompatibel dengan OpenAI, tidak diperlukan middleware tambahan. Jendela konteks 100.000 token memungkinkan editor mempertahankan konteks di atas file besar atau tugas pengubahan ulang multi-file, yang merupakan keterbatasan umum dalam model konteks yang lebih kecil.
Pertukaran: Anda tidak akan memiliki akses ke model milik perusahaan seperti GPT-4 atau Claude kecuali Anda mengubah konfigurasi secara manual. Namun, untuk pembuatan dan pengeditan kode murni, endpoint tanpa sensor ini sering memberikan hasil yang lebih cepat dan lebih konsisten tanpa gangguan kebijakan.
Menghubungkan Claude Code
Claude Code adalah agen baris perintah yang dikembangkan oleh Anthropic. Meskipun biasanya menggunakan API Anthropic, agen ini dapat dikonfigurasi untuk menggunakan endpoint apa pun yang kompatibel dengan OpenAI jika klien mendukungnya. Ini membuat API kami menjadi alternatif yang layak bagi pengguna yang lebih menyukai perilaku tanpa sensor dari model kami tetapi menyukai antarmuka Claude Code.
Untuk menghubungkan, Anda perlu memastikan bahwa klien Anda mendukung URL dasar kustom. Perbarui konfigurasi untuk menunjuk ke https://api.getcodexapi.com/v1 dan atur model menjadi uncensored. Anda juga perlu menyediakan kunci API Anda.
Pengaturan ini berguna bagi pengembang yang menginginkan kemampuan pemanggilan alat yang kuat dari agen pemrograman tetapi membutuhkan model yang tidak menolak pola kode yang kompleks atau tidak biasa. Perhatikan bahwa meskipun antarmuka tetap sama, perilaku model dasar akan berbeda dari model Claude standar. Selalu uji alur kerja spesifik Anda untuk memastikan model tanpa sensor memenuhi standar kualitas kode Anda.
Menggunakan SDK OpenAI
SDK OpenAI untuk Python atau Node.js dirancang untuk bekerja dengan endpoint apa pun yang kompatibel dengan OpenAI. Anda dapat beralih ke API kami dengan mengubah URL dasar dan kunci API.
Berikut cara Anda menginisialisasi klien di Python:
from openai import OpenAI
client = OpenAI(
base_url="https://api.getcodexapi.com/v1",
api_key="your-api-key"
)
Kemudian, Anda dapat memanggil endpoint penyelesaian obrolan seperti biasa:
response = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Write a Python function to sort a list."}]
)
Kesederhanaan ini memungkinkan Anda mengganti model dasar tanpa menulis ulang logika inti agen Anda. SDK menangani serialisasi dan parsing respons, sehingga Anda dapat fokus pada logika aplikasi.
Respons Streaming untuk Umpan Balik Waktu Nyata
Untuk agen pemrograman yang memberikan saran kode waktu nyata, streaming sangat penting. API kami mendukung Server-Sent Events (SSE) untuk respons streaming. Ini memungkinkan agen menampilkan kode saat sedang dihasilkan, meningkatkan pengalaman pengguna.
- Atur
stream=Truedalam permintaan API Anda. - Baca potongan stream secara bertahap.
- Perbarui UI atau editor dengan setiap potongan.
Ini mengurangi latensi yang dirasakan, terutama untuk blok kode besar. Karena model kami memiliki jendela konteks 100.000 token, Anda dapat men-stream respons yang mencakup jumlah konteks yang besar tanpa khawatir tentang pemotongan.
Catatan: Streaming tidak mengubah harga atau penghitungan token. Token ditagihkan berdasarkan total input dan output, terlepas dari apakah respons di-stream atau dikembalikan dalam satu blok.
Menangani Pemanggilan Fungsi Alat
Agen coding AI sering menggunakan pemanggilan fungsi untuk berinteraksi dengan alat eksternal, seperti menjalankan perintah terminal atau membaca file. API kami mendukung fitur ini, memungkinkan Anda menentukan skema fungsi dalam permintaan Anda.
- Tentukan fungsi Anda dalam parameter
functions. - Model akan mengembalikan respons dengan objek
function_call. - Agen Anda menjalankan fungsi dan mengirimkan hasilnya kembali ke model.
- Model menghasilkan respons berikutnya berdasarkan hasil tersebut.
Interaksi multi-gilir ini sangat penting untuk tugas coding yang kompleks. Misalnya, agen mungkin perlu membaca file, menganalisisnya, lalu menghasilkan perbaikan. API kami menangani ini dengan mulus, mempertahankan konteks di seluruh giliran dalam batas 100.000 token.
Mengelola Batas Laju
Untuk memastikan penggunaan yang adil dan stabilitas, API kami memberlakukan batas 300 permintaan per menit per kunci. Ukuran badan permintaan maksimum adalah 8 MB. Jika Anda melebihi batas ini, Anda akan menerima kesalahan 429 Too Many Requests.
Praktik terbaik:
- Terapkan backoff eksponensial dalam logika ulang agen Anda.
- Gunakan streaming untuk mengurangi jumlah panggilan API untuk respons besar.
- Pantau penggunaan Anda melalui dasbor untuk menghindari biaya tak terduga.
Jika Anda perlu memutar kunci, Anda dapat membuat ulang kunci API Anda kapan saja. Ini akan mencabut kunci lama, jadi pastikan untuk memperbarui agen Anda sebelum membuat ulang.