AI Gateway

Dokumentasi Token AI

API kompatibel OpenAI dan Anthropic. Pemakaian token ditagih dengan rumus (prompt + completion) × multiplier.

OpenCode Quickstart

Isi kolom API KEY, salin lalu jalankan di terminal Linux / Ubuntu (Bash).

Isi kolom API KEY, Salin lalu jalankan di Terminal macOS (Bash).

Isi kolom API KEY, Buka Windows PowerShell lalu paste command di bawah. (Klik kanan untuk paste di PowerShell.)

Isi kolom API KEY, Hanya untuk Command Prompt (cmd.exe). Jangan jalankan di PowerShell — akan error. Buka Run → cmd lalu paste command di bawah.

Apa yang dilakukan script ini?

  • Memeriksa apakah opencode sudah terpasang; jika belum, menginstalnya dengan installer resmi.
  • Mengambil daftar model yang tersedia dari /v1/models.
  • Menulis konfigurasi ke opencode.json dan opencode.jsonc.
  • Menetapkan API key Anda sebagai provider default.

OpenAI SDK

Base URL

https://ai.godentopup.com/v1

Gunakan API key sebagai Bearer token.

Anthropic SDK

Base URL

https://ai.godentopup.com

Anthropic SDK mengirim key lewat header x-api-key.

curl

curl https://ai.godentopup.com/v1/chat/completions \\\n  -H "Authorization: Bearer ***" \\\n  -H "Content-Type: application/json" \\\n  -d '{"model":"MODEL","messages":[{"role":"user","content":"Halo"}]}'

Model aktif

ModelCapabilityGradeMultiplier
auto-debug T Grade C 5.00x
deepseek-v4-flash T Grade A 2.10x
deepseek-v4-flash-0731 T Grade A 2.00x
deepseek-v4-flash-vision-exp TV Grade A 2.60x
deepseek-v4-mod T Grade A 1.30x
deepseek-v4-pro T Grade A 1.20x
deepseek-v4-pro-0813 T Grade A 1.90x
glm-5.1 T Grade A 1.00x
glm-5.2 T Grade A 1.30x
glm-5.3 T Grade A 2.00x
glm-5.3-flash TV Grade A 2.30x
hy3 T Grade A 0.90x
kimi-k2.7-code T Grade A 1.00x
kimi-k2.7-code-highspeed T Grade A 1.55x
kimi-k3 TV Grade A 2.20x
mimo-v2.5-pro T Grade A 1.50x
minimax-m3 T Grade A 1.50x
xyrz/claude-fable-5 TV Grade B 8.70x
xyrz/claude-opus-4.7 TV Grade A 5.30x
xyrz/claude-opus-5 TV Grade B 6.20x
xyrz/gpt-5.5 TV Grade A 3.60x
xyrz/gpt-5.6-luna TV Grade A 3.30x
xyrz/gpt-5.6-sol TV Grade A 6.20x
xyrz/gpt-5.6-terra TV Grade A 5.20x
xyrz/kimi-k3 TV Grade A 4.50x
xyrz/qwen3.7-max T Grade A 2.60x
xyrz/qwen3.7-plus TV Grade A 1.50x
auto T Grade B 1.00x

Out of Stock

Model berikut sedang tidak tersedia.

ModelCapabilityContext
claude-fable-5-bTV1.000.000
claude-opus-5TV1.000.000
claude-opus-5-bTV1.000.000
claude-sonnet-5TV1.000.000
claude-sonnet-5-bTV200.000
gpt-5.6TV400.000
gpt-5.6-lunaTV400.000
gpt-5.6-solTV400.000
gpt-5.6-sol-xhighTV400.000
gpt-5.6-terraTV400.000

Kode error

400 payload/model · 401 key tidak valid · 402 kuota habis · 403 expired/suspended/revoked · 429 RPM · 502 upstream gagal

Frequently Asked Questions

Apa itu Capability Text dan Vision?

Setiap agent (model) memiliki kemampuan berbeda. Capability menunjukkan jenis data yang dapat diproses oleh model:

T

Text — Model dapat memproses dan menghasilkan teks. Cocok untuk chat, reasoning, coding, analisis dokumen, dan tugas berbasis teks lainnya.

V

Vision — Model dapat memproses gambar bersama teks. Cocok untuk OCR, analisis gambar, deskripsi visual, dan ekstraksi informasi dari grafik/tabulasi.

Model dengan capability "Text + Vision" dapat melakukan kedua hal di atas, sehingga lebih fleksibel untuk use case kompleks.

Apa itu Model Multiplier?

Model Multiplier adalah pengali konsumsi token untuk setiap model. Secara default semua model menggunakan multiplier 1x, artinya token yang terpakai dihitung 1:1 terhadap quota Anda.

Jika sebuah model diatur ke multiplier 1.5x, maka setiap token yang dikonsumsi akan dihitung 1.5 kali lipat terhadap quota. Contoh: upstream menghitung 1.000 token, maka quota Anda berkurang 1.500 token.

Multiplier ditampilkan di daftar Available Models di tab Customer, misalnya glm-5.2-debug (1.5x). Model tanpa tanda kurung berarti tetap 1x.

Apa arti Grade Model?

Grade membantu Anda memilih model berdasarkan kualitas dan performa layanan. Grade tidak menilai kemampuan dasar model secara mutlak; pengalaman dapat berubah sesuai kondisi layanan.

A

Kualitas unggulan. Berasal dari layanan ternama dengan kualitas dan performa yang baik.

B

Performa terbatas. Berasal dari layanan baru atau layanan dengan batas request per menit yang sangat kecil, sehingga performanya mungkin kurang optimal.

C

Pilihan ekonomis. Performa layanan sangat rendah, tetapi tersedia di ai.godentopup.com dengan harga lebih murah.

Bagaimana token dan quota dihitung?

Setelah setiap request berhasil, sistem membaca data penggunaan dari respons model: prompt token (pesan/instruksi yang dikirim) dan completion token (jawaban model). Keduanya dijumlahkan menjadi total token, lalu dicatat ke usage akun dan riwayat per model.

Jika upstream tidak mengirim data prompt token yang lengkap, sistem memakai estimasi minimum dari isi pesan agar pemakaian tetap tercatat. Untuk request gambar, estimasi token gambar dari konfigurasi model juga ikut diperhitungkan. Cache token dicatat sebagai informasi penggunaan, tetapi quota utama tetap memakai total token yang ditagihkan model.

Rumus sederhana

(prompt token + completion token) × multiplier model

Hasilnya dibulatkan lalu dikurangi dari quota. Saat total penggunaan mencapai quota, API key menjadi exceeded dan request berikutnya ditolak sampai quota ditambah.

Simulasi mudah

Misal quota awal Anda 1.000.000 token. Anda mengirim request dengan 800 prompt token dan model menjawab 1.200 completion token.

Model 1x

(800 + 1.200) × 1 = 2.000 token terpakai.

Sisa quota: 1.000.000 − 2.000 = 998.000 token.

Model 1,5x

(800 + 1.200) × 1,5 = 3.000 token terpakai.

Sisa quota: 1.000.000 − 3.000 = 997.000 token.

Notifikasi

Tidak ada Notifikasi

Kamu akan mendapatkan informasi terbaru di sini.