AI Gateway
Dokumentasi Token AI
API kompatibel OpenAI dan Anthropic. Pemakaian token ditagih dengan rumus (prompt + completion) × multiplier.
OpenAI SDK
Base URL
https://ai.godentopup.com/v1
Gunakan API key sebagai Bearer token.
Anthropic SDK
Base URL
https://ai.godentopup.com
Anthropic SDK mengirim key lewat header x-api-key.
curl
curl https://ai.godentopup.com/v1/chat/completions \\\n -H "Authorization: Bearer ***" \\\n -H "Content-Type: application/json" \\\n -d '{"model":"MODEL","messages":[{"role":"user","content":"Halo"}]}'
Model aktif
| Model | Capability | Grade | Multiplier | |
|---|---|---|---|---|
| Model belum tersedia. | ||||
Kode error
400 payload/model · 401 key tidak valid · 402 kuota habis · 403 expired/suspended/revoked · 429 RPM · 502 upstream gagal
Frequently Asked Questions
Apa itu Capability Text dan Vision?
Setiap agent (model) memiliki kemampuan berbeda. Capability menunjukkan jenis data yang dapat diproses oleh model:
Text — Model dapat memproses dan menghasilkan teks. Cocok untuk chat, reasoning, coding, analisis dokumen, dan tugas berbasis teks lainnya.
Vision — Model dapat memproses gambar bersama teks. Cocok untuk OCR, analisis gambar, deskripsi visual, dan ekstraksi informasi dari grafik/tabulasi.
Model dengan capability "Text + Vision" dapat melakukan kedua hal di atas, sehingga lebih fleksibel untuk use case kompleks.
Apa itu Model Multiplier?
Model Multiplier adalah pengali konsumsi token untuk setiap model. Secara default semua model menggunakan multiplier 1x, artinya token yang terpakai dihitung 1:1 terhadap quota Anda.
Jika sebuah model diatur ke multiplier 1.5x, maka setiap token yang dikonsumsi akan dihitung 1.5 kali lipat terhadap quota. Contoh: upstream menghitung 1.000 token, maka quota Anda berkurang 1.500 token.
Multiplier ditampilkan di daftar Available Models di tab Customer, misalnya glm-5.2-debug (1.5x). Model tanpa tanda kurung berarti tetap 1x.
Apa arti Grade Model?
Grade membantu Anda memilih model berdasarkan kualitas dan performa layanan. Grade tidak menilai kemampuan dasar model secara mutlak; pengalaman dapat berubah sesuai kondisi layanan.
Kualitas unggulan. Berasal dari layanan ternama dengan kualitas dan performa yang baik.
Performa terbatas. Berasal dari layanan baru atau layanan dengan batas request per menit yang sangat kecil, sehingga performanya mungkin kurang optimal.
Pilihan ekonomis. Performa layanan sangat rendah, tetapi tersedia di bandelbanget.xyz dengan harga lebih murah.
Bagaimana token dan quota dihitung?
Setelah setiap request berhasil, sistem membaca data penggunaan dari respons model: prompt token (pesan/instruksi yang dikirim) dan completion token (jawaban model). Keduanya dijumlahkan menjadi total token, lalu dicatat ke usage akun dan riwayat per model.
Jika upstream tidak mengirim data prompt token yang lengkap, sistem memakai estimasi minimum dari isi pesan agar pemakaian tetap tercatat. Untuk request gambar, estimasi token gambar dari konfigurasi model juga ikut diperhitungkan. Cache token dicatat sebagai informasi penggunaan, tetapi quota utama tetap memakai total token yang ditagihkan model.
Rumus sederhana
(prompt token + completion token) × multiplier model
Hasilnya dibulatkan lalu dikurangi dari quota. Saat total penggunaan mencapai quota, API key menjadi exceeded dan request berikutnya ditolak sampai quota ditambah.
Simulasi mudah
Misal quota awal Anda 1.000.000 token. Anda mengirim request dengan 800 prompt token dan model menjawab 1.200 completion token.
Model 1x
(800 + 1.200) × 1 = 2.000 token terpakai.
Sisa quota: 1.000.000 − 2.000 = 998.000 token.
Model 1,5x
(800 + 1.200) × 1,5 = 3.000 token terpakai.
Sisa quota: 1.000.000 − 3.000 = 997.000 token.