Untuk agen AI: panduan pengaturan langkah demi langkah — /docs/agents.md, indeks dokumentasi — /llms.txt.
Model
Model jaringan Gonka yang tersedia melalui gateway: ID untuk field model, jendela konteks, batas respons, harga, dan status.
Model dan harga#
Daftar model berubah melalui voting jaringan Gonka, sehingga tabel ini disusun dari data live gateway. Harga dalam dolar per 1M token menurut kurs GNK saat ini; debit dilakukan dalam GNK, selengkapnya di bagian Tarif dan akun.
| Model | Konteks | Respons | Input, $/1M | Output, $/1M | Status |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Menurun |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Menurun |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Beroperasi |
Masukkan ID ke field model; huruf besar/kecil tidak berpengaruh. Status dihitung dari proporsi permintaan yang berhasil diproses, seperti di halaman Status jaringan.
Cara memilih model#
- Bingung mau mulai dari mana? Pilih
MiniMaxAI/MiniMax-M2.7: contoh dokumentasi dan perintah installer dirancang untuk model ini. - Konteks terpanjang —
zai-org/GLM-5.3-Flash: 390K token. Untuk basis kode besar dan dokumen panjang. - Respons terpanjang —
deepseek-ai/DeepSeek-V4-Flash-0731: hingga 33K token sekaligus. Untuk menghasilkan file besar secara utuh.
Jika jaringan berhenti melayani suatu model, model itu hilang dari GET /v1/models, dan permintaan ke sana menerima respons 503 dengan tipe error model_unavailable. Teks error akan menyebutkan model yang bisa Anda beralih ke sana.
Panjang respons#
Panjang respons ditentukan oleh max_tokens — atau max_completion_tokens, gateway memahami kedua field. Setiap model punya plafon: max_tokens yang lebih besar akan dipotong diam-diam oleh gateway ke plafon tersebut. Jika max_tokens tidak diisi, dengan stream: true plafon akan digunakan, sedangkan tanpa streaming — nilai default yang lebih kecil.
Model dengan penalaran menghabiskan sebagian max_tokens untuk berpikir sebelum menjawab — sisakan cadangan.
model | Plafon | Default, stream: true | Default, tanpa streaming |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Angka yang sama dalam format mesin — di respons GET /v1/capabilities, field limits.models.
Model default#
Permintaan tanpa field model akan dikirim gateway ke model default — saat ini MiniMaxAI/MiniMax-M2.7.
Claude Code dan Anthropic SDK mengirim nama model Anthropic (claude-*) di /v1/messages — gateway menggantinya dengan model default yang sama.
Untuk bekerja dengan model lain, tentukan ID-nya dari tabel di atas; di installer ini adalah flag --model.
Daftar dan status via API#
Daftar model berubah melalui voting jaringan Gonka — jangan hardcode daftarnya di kode, ambil dari API. Tidak perlu kunci untuk permintaan ini.
| Permintaan | Yang dikembalikan |
|---|---|
GET /v1/models | Model yang tersedia saat ini: ID, konteks, batas respons, dan harga token dalam dolar. Model yang sedang tidak dilayani jaringan tidak ada dalam daftar. |
GET /v1/models/{model} | Satu model dalam format yang sama. Slash di ID bisa dikirim apa adanya atau sebagai %2F. Model tidak dikenal atau tersembunyi — 404 dengan kode model_not_found, sedangkan permintaan ke model tersembunyi menerima 503 model_unavailable. |
GET /v1/capabilities | Kemampuan gateway: protokol, parameter permintaan, dan field limits — batas permintaan kunci, timeout, dan plafon max_tokens per model. |
GET /v1/network-status | Status setiap model dan insiden — data yang sama seperti di halaman Status jaringan. |
GET /health | Apakah gateway itu sendiri merespons: {"status":"ok"}. Permintaan ini tidak memeriksa status model. |