> Dla agentów AI: instrukcja konfiguracji krok po kroku — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), indeks dokumentacji — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Modele

Modele sieci Gonka dostępne przez bramę: identyfikator do pola `model`, okno kontekstu, limit odpowiedzi, cena i status.

## Modele i ceny

Skład modeli zmienia się w wyniku głosowań sieci Gonka, dlatego tabela jest budowana z danych na żywo z bramy. Ceny — w dolarach za 1M tokenów według aktualnego kursu GNK; obciążenie następuje w GNK, więcej — w sekcji [Cennik i konto](https://gate.joingonka.ai/pl/docs/billing).

| Model | Kontekst | Odpowiedź | Wejście, `$/1M` | Wyjście, `$/1M` | Status |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Obniżona jakość |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Obniżona jakość |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Działa |

Identyfikator wstaw w pole `model`; wielkość liter nie ma znaczenia. Status jest liczony na podstawie odsetka pomyślnie przetworzonych zapytań, jak na stronie [Status sieci](https://gate.joingonka.ai/pl/status).

## Jak wybrać model

- Nie wiesz, od czego zacząć — weź `MiniMaxAI/MiniMax-M2.7`: na niego są przygotowane przykłady w dokumentacji i polecenia instalatora.
- Najdłuższy kontekst — `zai-org/GLM-5.3-Flash`: 390K tokenów. Do dużych baz kodu i długich dokumentów.
- Najdłuższa odpowiedź — `deepseek-ai/DeepSeek-V4-Flash-0731`: do 33K tokenów na raz. Do generowania dużych plików w całości.

Jeśli sieć przestaje obsługiwać model, ten znika z `GET /v1/models`, a zapytania do niego otrzymują odpowiedź 503 z typem błędu `model_unavailable`. W treści błędu znajdzie się model, na który można się przełączyć.

## Długość odpowiedzi

Długość odpowiedzi określa `max_tokens` — lub `max_completion_tokens`, brama rozumie oba pola. Każdy model ma swój pułap: większy `max_tokens` brama po cichu przycina do niego. Jeśli `max_tokens` nie jest ustawiony, przy `stream: true` podstawiany jest pułap, a bez streamingu — mniejsza wartość domyślna.

Modele z rozumowaniem zużywają część `max_tokens` na myślenie przed odpowiedzią — zostaw zapas.

| `model` | Pułap | Domyślnie, `stream: true` | Domyślnie, bez streamingu |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Te same liczby w formie maszynowej — w odpowiedzi `GET /v1/capabilities`, pole `limits.models`.

## Model domyślny

Zapytanie bez pola `model` brama kieruje do modelu domyślnego — obecnie jest to `MiniMaxAI/MiniMax-M2.7`.

Claude Code i Anthropic SDK przesyłają w `/v1/messages` nazwy modeli Anthropic (`claude-*`) — brama zastępuje je tym samym modelem domyślnym.

Aby pracować z innym modelem, podaj jego identyfikator z tabeli powyżej; w instalatorze to flaga `--model`.

## Skład i status przez API

Skład modeli zmienia się w wyniku głosowań sieci Gonka — nie wpisuj listy na stałe w kod, pobieraj ją z API. Klucz do tych zapytań nie jest potrzebny.

| Zapytanie | Co zwraca |
| --- | --- |
| `GET /v1/models` | Modele dostępne teraz: identyfikator, kontekst, limit odpowiedzi i cena tokena w dolarach. Modelu, którego sieć obecnie nie obsługuje, nie ma na liście. |
| `GET /v1/models/{model}` | Jeden model w tym samym formacie. Ukośnik w identyfikatorze przekazuj jako jest lub jako `%2F`. Nieznany lub ukryty model — `404` z kodem `model_not_found`, a zapytanie do ukrytego modelu otrzymuje `503 model_unavailable`. |
| `GET /v1/capabilities` | Możliwości bramy: protokoły, parametry zapytania i pole `limits` — limit zapytań klucza, timeouty i pułapy `max_tokens` dla modeli. |
| `GET /v1/network-status` | Status każdego modelu i incydenty — te same dane co na stronie [Status sieci](https://gate.joingonka.ai/pl/status). |
| `GET /health` | Czy sama brama odpowiada: `{"status":"ok"}`. To zapytanie nie sprawdza stanu modeli. |
