Dla agentów AI: instrukcja konfiguracji krok po kroku — /docs/agents.md, indeks dokumentacji — /llms.txt.
Modele
Modele sieci Gonka dostępne przez bramę: identyfikator do pola model, okno kontekstu, limit odpowiedzi, cena i status.
Modele i ceny#
Skład modeli zmienia się w wyniku głosowań sieci Gonka, dlatego tabela jest budowana z danych na żywo z bramy. Ceny — w dolarach za 1M tokenów według aktualnego kursu GNK; obciążenie następuje w GNK, więcej — w sekcji Cennik i konto.
| Model | Kontekst | Odpowiedź | Wejście, $/1M | Wyjście, $/1M | Status |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Obniżona jakość |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Obniżona jakość |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Działa |
Identyfikator wstaw w pole model; wielkość liter nie ma znaczenia. Status jest liczony na podstawie odsetka pomyślnie przetworzonych zapytań, jak na stronie Status sieci.
Jak wybrać model#
- Nie wiesz, od czego zacząć — weź
MiniMaxAI/MiniMax-M2.7: na niego są przygotowane przykłady w dokumentacji i polecenia instalatora. - Najdłuższy kontekst —
zai-org/GLM-5.3-Flash: 390K tokenów. Do dużych baz kodu i długich dokumentów. - Najdłuższa odpowiedź —
deepseek-ai/DeepSeek-V4-Flash-0731: do 33K tokenów na raz. Do generowania dużych plików w całości.
Jeśli sieć przestaje obsługiwać model, ten znika z GET /v1/models, a zapytania do niego otrzymują odpowiedź 503 z typem błędu model_unavailable. W treści błędu znajdzie się model, na który można się przełączyć.
Długość odpowiedzi#
Długość odpowiedzi określa max_tokens — lub max_completion_tokens, brama rozumie oba pola. Każdy model ma swój pułap: większy max_tokens brama po cichu przycina do niego. Jeśli max_tokens nie jest ustawiony, przy stream: true podstawiany jest pułap, a bez streamingu — mniejsza wartość domyślna.
Modele z rozumowaniem zużywają część max_tokens na myślenie przed odpowiedzią — zostaw zapas.
model | Pułap | Domyślnie, stream: true | Domyślnie, bez streamingu |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Te same liczby w formie maszynowej — w odpowiedzi GET /v1/capabilities, pole limits.models.
Model domyślny#
Zapytanie bez pola model brama kieruje do modelu domyślnego — obecnie jest to MiniMaxAI/MiniMax-M2.7.
Claude Code i Anthropic SDK przesyłają w /v1/messages nazwy modeli Anthropic (claude-*) — brama zastępuje je tym samym modelem domyślnym.
Aby pracować z innym modelem, podaj jego identyfikator z tabeli powyżej; w instalatorze to flaga --model.
Skład i status przez API#
Skład modeli zmienia się w wyniku głosowań sieci Gonka — nie wpisuj listy na stałe w kod, pobieraj ją z API. Klucz do tych zapytań nie jest potrzebny.
| Zapytanie | Co zwraca |
|---|---|
GET /v1/models | Modele dostępne teraz: identyfikator, kontekst, limit odpowiedzi i cena tokena w dolarach. Modelu, którego sieć obecnie nie obsługuje, nie ma na liście. |
GET /v1/models/{model} | Jeden model w tym samym formacie. Ukośnik w identyfikatorze przekazuj jako jest lub jako %2F. Nieznany lub ukryty model — 404 z kodem model_not_found, a zapytanie do ukrytego modelu otrzymuje 503 model_unavailable. |
GET /v1/capabilities | Możliwości bramy: protokoły, parametry zapytania i pole limits — limit zapytań klucza, timeouty i pułapy max_tokens dla modeli. |
GET /v1/network-status | Status każdego modelu i incydenty — te same dane co na stronie Status sieci. |
GET /health | Czy sama brama odpowiada: {"status":"ok"}. To zapytanie nie sprawdza stanu modeli. |