Untuk agen AI: panduan pengaturan langkah demi langkah — /docs/agents.md, indeks dokumentasi — /llms.txt.

Model

Model jaringan Gonka yang tersedia melalui gateway: ID untuk field model, jendela konteks, batas respons, harga, dan status.

Model dan harga#

Daftar model berubah melalui voting jaringan Gonka, sehingga tabel ini disusun dari data live gateway. Harga dalam dolar per 1M token menurut kurs GNK saat ini; debit dilakukan dalam GNK, selengkapnya di bagian Tarif dan akun.

ModelKonteksResponsInput, $/1MOutput, $/1MStatus
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Menurun
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Menurun
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025Beroperasi

Masukkan ID ke field model; huruf besar/kecil tidak berpengaruh. Status dihitung dari proporsi permintaan yang berhasil diproses, seperti di halaman Status jaringan.

Cara memilih model#

  • Bingung mau mulai dari mana? Pilih MiniMaxAI/MiniMax-M2.7: contoh dokumentasi dan perintah installer dirancang untuk model ini.
  • Konteks terpanjang — zai-org/GLM-5.3-Flash: 390K token. Untuk basis kode besar dan dokumen panjang.
  • Respons terpanjang — deepseek-ai/DeepSeek-V4-Flash-0731: hingga 33K token sekaligus. Untuk menghasilkan file besar secara utuh.

Jika jaringan berhenti melayani suatu model, model itu hilang dari GET /v1/models, dan permintaan ke sana menerima respons 503 dengan tipe error model_unavailable. Teks error akan menyebutkan model yang bisa Anda beralih ke sana.

Panjang respons#

Panjang respons ditentukan oleh max_tokens — atau max_completion_tokens, gateway memahami kedua field. Setiap model punya plafon: max_tokens yang lebih besar akan dipotong diam-diam oleh gateway ke plafon tersebut. Jika max_tokens tidak diisi, dengan stream: true plafon akan digunakan, sedangkan tanpa streaming — nilai default yang lebih kecil.

Model dengan penalaran menghabiskan sebagian max_tokens untuk berpikir sebelum menjawab — sisakan cadangan.

modelPlafonDefault, stream: trueDefault, tanpa streaming
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Angka yang sama dalam format mesin — di respons GET /v1/capabilities, field limits.models.

Model default#

Permintaan tanpa field model akan dikirim gateway ke model default — saat ini MiniMaxAI/MiniMax-M2.7.

Claude Code dan Anthropic SDK mengirim nama model Anthropic (claude-*) di /v1/messages — gateway menggantinya dengan model default yang sama.

Untuk bekerja dengan model lain, tentukan ID-nya dari tabel di atas; di installer ini adalah flag --model.

Daftar dan status via API#

Daftar model berubah melalui voting jaringan Gonka — jangan hardcode daftarnya di kode, ambil dari API. Tidak perlu kunci untuk permintaan ini.

PermintaanYang dikembalikan
GET /v1/modelsModel yang tersedia saat ini: ID, konteks, batas respons, dan harga token dalam dolar. Model yang sedang tidak dilayani jaringan tidak ada dalam daftar.
GET /v1/models/{model}Satu model dalam format yang sama. Slash di ID bisa dikirim apa adanya atau sebagai %2F. Model tidak dikenal atau tersembunyi — 404 dengan kode model_not_found, sedangkan permintaan ke model tersembunyi menerima 503 model_unavailable.
GET /v1/capabilitiesKemampuan gateway: protokol, parameter permintaan, dan field limits — batas permintaan kunci, timeout, dan plafon max_tokens per model.
GET /v1/network-statusStatus setiap model dan insiden — data yang sama seperti di halaman Status jaringan.
GET /healthApakah gateway itu sendiri merespons: {"status":"ok"}. Permintaan ini tidak memeriksa status model.