> Para sa mga AI agent: step-by-step na gabay sa setup — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), index ng dokumentasyon — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Mga Modelo

Mga modelo ng Gonka network na available sa pamamagitan ng gateway: identifier para sa field na `model`, context window, limitasyon ng sagot, presyo at status.

## Mga modelo at presyo

Nagbabago ang komposisyon ng mga modelo sa pamamagitan ng mga boto ng Gonka network, kaya ang talahanayan ay binuo mula sa live na data ng gateway. Ang mga presyo — sa dolyar kada 1M token ayon sa kasalukuyang rate ng GNK; ang pagbawas ay sa GNK, higit pang detalye — sa seksyong [Presyo at Account](https://gate.joingonka.ai/tl/docs/billing).

| Modelo | Konteksto | Sagot | Input, `$/1M` | Output, `$/1M` | Status |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Degraded |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Degraded |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Gumagana |

Ilagay ang identifier sa field na `model`; hindi mahalaga ang case ng mga titik. Ang status ay kinakalkula ayon sa bahagi ng matagumpay na naprosesong mga request, tulad ng sa page na [Status ng network](https://gate.joingonka.ai/tl/status).

## Paano pumili ng modelo

- Kung hindi mo alam kung saan magsisimula — piliin ang `MiniMaxAI/MiniMax-M2.7`: dito naka-base ang mga halimbawa ng dokumentasyon at mga command ng installer.
- Ang pinakamahabang context — `zai-org/GLM-5.3-Flash`: 390K token. Para sa malalaking codebase at mahabang dokumento.
- Ang pinakamahabang sagot — `deepseek-ai/DeepSeek-V4-Flash-0731`: hanggang 33K token sa isang pagkakataon. Para makabuo ng malalaking file nang buo.

Kung ang network ay huminto sa pagserbisyo ng isang modelo, nawawala ito sa `GET /v1/models`, at ang mga request dito ay nakakakuha ng sagot na 503 na may error type na `model_unavailable`. Sa teksto ng error ay makikita ang modelo kung saan maaari kang lumipat.

## Haba ng sagot

Ang haba ng sagot ay itinakda ng `max_tokens` — o `max_completion_tokens`, nauunawaan ng gateway ang parehong field. Bawat modelo ay may kisame: ang mas malaking `max_tokens` ay tahimik na pinuputol ng gateway dito. Kung ang `max_tokens` ay hindi nakatakda, sa `stream: true` ay ipinapasok ang kisame, at kung walang stream — ang mas maliit na default na halaga.

Ang mga modelong may reasoning ay gumugugol ng bahagi ng `max_tokens` sa pag-iisip bago sumagot — mag-iwan ng reserba.

| `model` | Kisame | Default, `stream: true` | Default, walang stream |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Ang parehong mga numero sa machine-readable na anyo — sa sagot na `GET /v1/capabilities`, field na `limits.models`.

## Default na modelo

Ang request na walang field na `model` ay ipinapadala ng gateway sa default na modelo — sa ngayon ito ay `MiniMaxAI/MiniMax-M2.7`.

Ang Claude Code at Anthropic SDK ay nagpapadala sa `/v1/messages` ng mga pangalan ng modelo ng Anthropic (`claude-*`) — pinapalitan ng gateway ang mga ito ng parehong default na modelo.

Upang gumana sa ibang modelo, tukuyin ang identifier nito mula sa talahanayan sa itaas; sa installer ito ay ang flag na `--model`.

## Komposisyon at status sa pamamagitan ng API

Nagbabago ang komposisyon ng mga modelo sa pamamagitan ng mga boto ng Gonka network — huwag i-hardcode ang listahan sa code, kunin ito mula sa API. Hindi kailangan ang key para sa mga request na ito.

| Request | Ano ang ibinabalik |
| --- | --- |
| `GET /v1/models` | Mga modelong available ngayon: identifier, context, limitasyon ng sagot at presyo ng token sa dolyar. Ang modelong hindi kasalukuyang sineserbisyo ng network ay wala sa listahan. |
| `GET /v1/models/{model}` | Isang modelo sa parehong format. Ang slash sa identifier ay ipasa nang ganito o bilang `%2F`. Ang hindi kilala o nakatagong modelo — `404` na may code na `model_not_found`, at ang request sa nakatagong modelo ay nakakakuha ng `503 model_unavailable`. |
| `GET /v1/capabilities` | Mga kakayahan ng gateway: mga protocol, mga parameter ng request at field na `limits` — limitasyon ng mga request ng key, mga timeout at mga kisame ng `max_tokens` ayon sa modelo. |
| `GET /v1/network-status` | Status ng bawat modelo at mga insidente — parehong data tulad ng sa page na [Status ng network](https://gate.joingonka.ai/tl/status). |
| `GET /health` | Kung tumutugon ba ang gateway mismo: `{"status":"ok"}`. Hindi sinusuri ng request na ito ang kalagayan ng mga modelo. |
