Para sa mga AI agent: step-by-step na gabay sa setup — /docs/agents.md, index ng dokumentasyon — /llms.txt.
Mga Modelo
Mga modelo ng Gonka network na available sa pamamagitan ng gateway: identifier para sa field na model, context window, limitasyon ng sagot, presyo at status.
Mga modelo at presyo#
Nagbabago ang komposisyon ng mga modelo sa pamamagitan ng mga boto ng Gonka network, kaya ang talahanayan ay binuo mula sa live na data ng gateway. Ang mga presyo — sa dolyar kada 1M token ayon sa kasalukuyang rate ng GNK; ang pagbawas ay sa GNK, higit pang detalye — sa seksyong Presyo at Account.
| Modelo | Konteksto | Sagot | Input, $/1M | Output, $/1M | Status |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Degraded |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Degraded |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Gumagana |
Ilagay ang identifier sa field na model; hindi mahalaga ang case ng mga titik. Ang status ay kinakalkula ayon sa bahagi ng matagumpay na naprosesong mga request, tulad ng sa page na Status ng network.
Paano pumili ng modelo#
- Kung hindi mo alam kung saan magsisimula — piliin ang
MiniMaxAI/MiniMax-M2.7: dito naka-base ang mga halimbawa ng dokumentasyon at mga command ng installer. - Ang pinakamahabang context —
zai-org/GLM-5.3-Flash: 390K token. Para sa malalaking codebase at mahabang dokumento. - Ang pinakamahabang sagot —
deepseek-ai/DeepSeek-V4-Flash-0731: hanggang 33K token sa isang pagkakataon. Para makabuo ng malalaking file nang buo.
Kung ang network ay huminto sa pagserbisyo ng isang modelo, nawawala ito sa GET /v1/models, at ang mga request dito ay nakakakuha ng sagot na 503 na may error type na model_unavailable. Sa teksto ng error ay makikita ang modelo kung saan maaari kang lumipat.
Haba ng sagot#
Ang haba ng sagot ay itinakda ng max_tokens — o max_completion_tokens, nauunawaan ng gateway ang parehong field. Bawat modelo ay may kisame: ang mas malaking max_tokens ay tahimik na pinuputol ng gateway dito. Kung ang max_tokens ay hindi nakatakda, sa stream: true ay ipinapasok ang kisame, at kung walang stream — ang mas maliit na default na halaga.
Ang mga modelong may reasoning ay gumugugol ng bahagi ng max_tokens sa pag-iisip bago sumagot — mag-iwan ng reserba.
model | Kisame | Default, stream: true | Default, walang stream |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Ang parehong mga numero sa machine-readable na anyo — sa sagot na GET /v1/capabilities, field na limits.models.
Default na modelo#
Ang request na walang field na model ay ipinapadala ng gateway sa default na modelo — sa ngayon ito ay MiniMaxAI/MiniMax-M2.7.
Ang Claude Code at Anthropic SDK ay nagpapadala sa /v1/messages ng mga pangalan ng modelo ng Anthropic (claude-*) — pinapalitan ng gateway ang mga ito ng parehong default na modelo.
Upang gumana sa ibang modelo, tukuyin ang identifier nito mula sa talahanayan sa itaas; sa installer ito ay ang flag na --model.
Komposisyon at status sa pamamagitan ng API#
Nagbabago ang komposisyon ng mga modelo sa pamamagitan ng mga boto ng Gonka network — huwag i-hardcode ang listahan sa code, kunin ito mula sa API. Hindi kailangan ang key para sa mga request na ito.
| Request | Ano ang ibinabalik |
|---|---|
GET /v1/models | Mga modelong available ngayon: identifier, context, limitasyon ng sagot at presyo ng token sa dolyar. Ang modelong hindi kasalukuyang sineserbisyo ng network ay wala sa listahan. |
GET /v1/models/{model} | Isang modelo sa parehong format. Ang slash sa identifier ay ipasa nang ganito o bilang %2F. Ang hindi kilala o nakatagong modelo — 404 na may code na model_not_found, at ang request sa nakatagong modelo ay nakakakuha ng 503 model_unavailable. |
GET /v1/capabilities | Mga kakayahan ng gateway: mga protocol, mga parameter ng request at field na limits — limitasyon ng mga request ng key, mga timeout at mga kisame ng max_tokens ayon sa modelo. |
GET /v1/network-status | Status ng bawat modelo at mga insidente — parehong data tulad ng sa page na Status ng network. |
GET /health | Kung tumutugon ba ang gateway mismo: {"status":"ok"}. Hindi sinusuri ng request na ito ang kalagayan ng mga modelo. |