> Untuk agen AI: panduan pengaturan langkah demi langkah — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), indeks dokumentasi — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Model

Model jaringan Gonka yang tersedia melalui gateway: ID untuk field `model`, jendela konteks, batas respons, harga, dan status.

## Model dan harga

Daftar model berubah melalui voting jaringan Gonka, sehingga tabel ini disusun dari data live gateway. Harga dalam dolar per 1M token menurut kurs GNK saat ini; debit dilakukan dalam GNK, selengkapnya di bagian [Tarif dan akun](https://gate.joingonka.ai/id/docs/billing).

| Model | Konteks | Respons | Input, `$/1M` | Output, `$/1M` | Status |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Menurun |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Menurun |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Beroperasi |

Masukkan ID ke field `model`; huruf besar/kecil tidak berpengaruh. Status dihitung dari proporsi permintaan yang berhasil diproses, seperti di halaman [Status jaringan](https://gate.joingonka.ai/id/status).

## Cara memilih model

- Bingung mau mulai dari mana? Pilih `MiniMaxAI/MiniMax-M2.7`: contoh dokumentasi dan perintah installer dirancang untuk model ini.
- Konteks terpanjang — `zai-org/GLM-5.3-Flash`: 390K token. Untuk basis kode besar dan dokumen panjang.
- Respons terpanjang — `deepseek-ai/DeepSeek-V4-Flash-0731`: hingga 33K token sekaligus. Untuk menghasilkan file besar secara utuh.

Jika jaringan berhenti melayani suatu model, model itu hilang dari `GET /v1/models`, dan permintaan ke sana menerima respons 503 dengan tipe error `model_unavailable`. Teks error akan menyebutkan model yang bisa Anda beralih ke sana.

## Panjang respons

Panjang respons ditentukan oleh `max_tokens` — atau `max_completion_tokens`, gateway memahami kedua field. Setiap model punya plafon: `max_tokens` yang lebih besar akan dipotong diam-diam oleh gateway ke plafon tersebut. Jika `max_tokens` tidak diisi, dengan `stream: true` plafon akan digunakan, sedangkan tanpa streaming — nilai default yang lebih kecil.

Model dengan penalaran menghabiskan sebagian `max_tokens` untuk berpikir sebelum menjawab — sisakan cadangan.

| `model` | Plafon | Default, `stream: true` | Default, tanpa streaming |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Angka yang sama dalam format mesin — di respons `GET /v1/capabilities`, field `limits.models`.

## Model default

Permintaan tanpa field `model` akan dikirim gateway ke model default — saat ini `MiniMaxAI/MiniMax-M2.7`.

Claude Code dan Anthropic SDK mengirim nama model Anthropic (`claude-*`) di `/v1/messages` — gateway menggantinya dengan model default yang sama.

Untuk bekerja dengan model lain, tentukan ID-nya dari tabel di atas; di installer ini adalah flag `--model`.

## Daftar dan status via API

Daftar model berubah melalui voting jaringan Gonka — jangan hardcode daftarnya di kode, ambil dari API. Tidak perlu kunci untuk permintaan ini.

| Permintaan | Yang dikembalikan |
| --- | --- |
| `GET /v1/models` | Model yang tersedia saat ini: ID, konteks, batas respons, dan harga token dalam dolar. Model yang sedang tidak dilayani jaringan tidak ada dalam daftar. |
| `GET /v1/models/{model}` | Satu model dalam format yang sama. Slash di ID bisa dikirim apa adanya atau sebagai `%2F`. Model tidak dikenal atau tersembunyi — `404` dengan kode `model_not_found`, sedangkan permintaan ke model tersembunyi menerima `503 model_unavailable`. |
| `GET /v1/capabilities` | Kemampuan gateway: protokol, parameter permintaan, dan field `limits` — batas permintaan kunci, timeout, dan plafon `max_tokens` per model. |
| `GET /v1/network-status` | Status setiap model dan insiden — data yang sama seperti di halaman [Status jaringan](https://gate.joingonka.ai/id/status). |
| `GET /health` | Apakah gateway itu sendiri merespons: `{"status":"ok"}`. Permintaan ini tidak memeriksa status model. |
