Für KI-Agenten: Schritt-für-Schritt-Anleitung zur Einrichtung — /docs/agents.md, Dokumentationsindex — /llms.txt.

Modelle

Die über das Gateway verfügbaren Modelle des Gonka-Netzwerks: Bezeichner für das Feld model, Kontextfenster, Antwortlimit, Preis und Status.

Modelle und Preise#

Die Zusammensetzung der Modelle ändert sich durch Abstimmungen im Gonka-Netzwerk, daher wird die Tabelle aus Live-Daten des Gateways erstellt. Preise in Dollar pro 1M Tokens zum aktuellen GNK-Kurs; abgebucht wird in GNK, mehr dazu im Abschnitt Tarife und Konto.

ModellKontextAntwortEingabe, $/1MAusgabe, $/1MStatus
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Beeinträchtigt
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Beeinträchtigt
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025In Betrieb

Den Bezeichner tragen Sie in das Feld model ein; die Groß-/Kleinschreibung spielt keine Rolle. Der Status wird anhand des Anteils erfolgreich verarbeiteter Anfragen berechnet, wie auf der Seite Netzwerkstatus.

Wie wählt man ein Modell aus#

  • Wenn Sie nicht wissen, wo Sie anfangen sollen, nehmen Sie MiniMaxAI/MiniMax-M2.7: darauf sind die Dokumentationsbeispiele und Installer-Befehle ausgelegt.
  • Der längste Kontext — zai-org/GLM-5.3-Flash: 390K Tokens. Für große Codebasen und lange Dokumente.
  • Die längste Antwort — deepseek-ai/DeepSeek-V4-Flash-0731: bis zu 33K Tokens auf einmal. Um große Dateien vollständig zu generieren.

Wenn das Netzwerk ein Modell nicht mehr bedient, verschwindet es aus GET /v1/models, und Anfragen an dasselbe erhalten die Antwort 503 mit dem Fehlertyp model_unavailable. Im Fehlertext steht das Modell, auf das Sie wechseln können.

Antwortlänge#

Die Antwortlänge bestimmt max_tokens — oder max_completion_tokens, das Gateway versteht beide Felder. Jedes Modell hat eine Obergrenze: ein größeres max_tokens schneidet das Gateway stillschweigend darauf zu. Wenn max_tokens nicht gesetzt ist, wird bei stream: true die Obergrenze eingesetzt, ohne Streaming ein kleinerer Standardwert.

Modelle mit Reasoning verwenden einen Teil von max_tokens für das Nachdenken vor der Antwort — lassen Sie Puffer.

modelObergrenzeStandard, stream: trueStandard, ohne Streaming
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Dieselben Zahlen in maschinenlesbarer Form — in der Antwort von GET /v1/capabilities, Feld limits.models.

Standardmodell#

Eine Anfrage ohne das Feld model schickt das Gateway an das Standardmodell — derzeit ist das MiniMaxAI/MiniMax-M2.7.

Claude Code und das Anthropic SDK senden in /v1/messages Anthropic-Modellnamen (claude-*) — das Gateway ersetzt sie durch dasselbe Standardmodell.

Um mit einem anderen Modell zu arbeiten, geben Sie dessen Bezeichner aus der Tabelle oben an; im Installer ist das das Flag --model.

Zusammensetzung und Status über die API#

Die Zusammensetzung der Modelle ändert sich durch Abstimmungen im Gonka-Netzwerk — schreiben Sie die Liste nicht in den Code fest, sondern holen Sie sie aus der API. Für diese Anfragen ist kein Schlüssel nötig.

AnfrageWas zurückgegeben wird
GET /v1/modelsDerzeit verfügbare Modelle: Bezeichner, Kontext, Antwortlimit und Tokenpreis in Dollar. Ein Modell, das das Netzwerk gerade nicht bedient, fehlt in der Liste.
GET /v1/models/{model}Ein einzelnes Modell im selben Format. Den Schrägstrich im Bezeichner übergeben Sie wie er ist oder als %2F. Ein unbekanntes oder verborgenes Modell — 404 mit dem Code model_not_found, und eine Anfrage an ein verborgenes Modell erhält 503 model_unavailable.
GET /v1/capabilitiesFähigkeiten des Gateways: Protokolle, Anfrageparameter und das Feld limits — das Anfragelimit des Schlüssels, Timeouts und max_tokens-Obergrenzen je Modell.
GET /v1/network-statusStatus jedes Modells und Vorfälle — dieselben Daten wie auf der Seite Netzwerkstatus.
GET /healthOb das Gateway selbst antwortet: {"status":"ok"}. Den Zustand der Modelle prüft diese Anfrage nicht.