Dla agentów AI: instrukcja konfiguracji krok po kroku — /docs/agents.md, indeks dokumentacji — /llms.txt.

Modele

Modele sieci Gonka dostępne przez bramę: identyfikator do pola model, okno kontekstu, limit odpowiedzi, cena i status.

Modele i ceny#

Skład modeli zmienia się w wyniku głosowań sieci Gonka, dlatego tabela jest budowana z danych na żywo z bramy. Ceny — w dolarach za 1M tokenów według aktualnego kursu GNK; obciążenie następuje w GNK, więcej — w sekcji Cennik i konto.

ModelKontekstOdpowiedźWejście, $/1MWyjście, $/1MStatus
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Obniżona jakość
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Obniżona jakość
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025Działa

Identyfikator wstaw w pole model; wielkość liter nie ma znaczenia. Status jest liczony na podstawie odsetka pomyślnie przetworzonych zapytań, jak na stronie Status sieci.

Jak wybrać model#

  • Nie wiesz, od czego zacząć — weź MiniMaxAI/MiniMax-M2.7: na niego są przygotowane przykłady w dokumentacji i polecenia instalatora.
  • Najdłuższy kontekst — zai-org/GLM-5.3-Flash: 390K tokenów. Do dużych baz kodu i długich dokumentów.
  • Najdłuższa odpowiedź — deepseek-ai/DeepSeek-V4-Flash-0731: do 33K tokenów na raz. Do generowania dużych plików w całości.

Jeśli sieć przestaje obsługiwać model, ten znika z GET /v1/models, a zapytania do niego otrzymują odpowiedź 503 z typem błędu model_unavailable. W treści błędu znajdzie się model, na który można się przełączyć.

Długość odpowiedzi#

Długość odpowiedzi określa max_tokens — lub max_completion_tokens, brama rozumie oba pola. Każdy model ma swój pułap: większy max_tokens brama po cichu przycina do niego. Jeśli max_tokens nie jest ustawiony, przy stream: true podstawiany jest pułap, a bez streamingu — mniejsza wartość domyślna.

Modele z rozumowaniem zużywają część max_tokens na myślenie przed odpowiedzią — zostaw zapas.

modelPułapDomyślnie, stream: trueDomyślnie, bez streamingu
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Te same liczby w formie maszynowej — w odpowiedzi GET /v1/capabilities, pole limits.models.

Model domyślny#

Zapytanie bez pola model brama kieruje do modelu domyślnego — obecnie jest to MiniMaxAI/MiniMax-M2.7.

Claude Code i Anthropic SDK przesyłają w /v1/messages nazwy modeli Anthropic (claude-*) — brama zastępuje je tym samym modelem domyślnym.

Aby pracować z innym modelem, podaj jego identyfikator z tabeli powyżej; w instalatorze to flaga --model.

Skład i status przez API#

Skład modeli zmienia się w wyniku głosowań sieci Gonka — nie wpisuj listy na stałe w kod, pobieraj ją z API. Klucz do tych zapytań nie jest potrzebny.

ZapytanieCo zwraca
GET /v1/modelsModele dostępne teraz: identyfikator, kontekst, limit odpowiedzi i cena tokena w dolarach. Modelu, którego sieć obecnie nie obsługuje, nie ma na liście.
GET /v1/models/{model}Jeden model w tym samym formacie. Ukośnik w identyfikatorze przekazuj jako jest lub jako %2F. Nieznany lub ukryty model — 404 z kodem model_not_found, a zapytanie do ukrytego modelu otrzymuje 503 model_unavailable.
GET /v1/capabilitiesMożliwości bramy: protokoły, parametry zapytania i pole limits — limit zapytań klucza, timeouty i pułapy max_tokens dla modeli.
GET /v1/network-statusStatus każdego modelu i incydenty — te same dane co na stronie Status sieci.
GET /healthCzy sama brama odpowiada: {"status":"ok"}. To zapytanie nie sprawdza stanu modeli.