Für KI-Agenten: Schritt-für-Schritt-Anleitung zur Einrichtung — /docs/agents.md, Dokumentationsindex — /llms.txt.
Modelle
Die über das Gateway verfügbaren Modelle des Gonka-Netzwerks: Bezeichner für das Feld model, Kontextfenster, Antwortlimit, Preis und Status.
Modelle und Preise#
Die Zusammensetzung der Modelle ändert sich durch Abstimmungen im Gonka-Netzwerk, daher wird die Tabelle aus Live-Daten des Gateways erstellt. Preise in Dollar pro 1M Tokens zum aktuellen GNK-Kurs; abgebucht wird in GNK, mehr dazu im Abschnitt Tarife und Konto.
| Modell | Kontext | Antwort | Eingabe, $/1M | Ausgabe, $/1M | Status |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Beeinträchtigt |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Beeinträchtigt |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | In Betrieb |
Den Bezeichner tragen Sie in das Feld model ein; die Groß-/Kleinschreibung spielt keine Rolle. Der Status wird anhand des Anteils erfolgreich verarbeiteter Anfragen berechnet, wie auf der Seite Netzwerkstatus.
Wie wählt man ein Modell aus#
- Wenn Sie nicht wissen, wo Sie anfangen sollen, nehmen Sie
MiniMaxAI/MiniMax-M2.7: darauf sind die Dokumentationsbeispiele und Installer-Befehle ausgelegt. - Der längste Kontext —
zai-org/GLM-5.3-Flash: 390K Tokens. Für große Codebasen und lange Dokumente. - Die längste Antwort —
deepseek-ai/DeepSeek-V4-Flash-0731: bis zu 33K Tokens auf einmal. Um große Dateien vollständig zu generieren.
Wenn das Netzwerk ein Modell nicht mehr bedient, verschwindet es aus GET /v1/models, und Anfragen an dasselbe erhalten die Antwort 503 mit dem Fehlertyp model_unavailable. Im Fehlertext steht das Modell, auf das Sie wechseln können.
Antwortlänge#
Die Antwortlänge bestimmt max_tokens — oder max_completion_tokens, das Gateway versteht beide Felder. Jedes Modell hat eine Obergrenze: ein größeres max_tokens schneidet das Gateway stillschweigend darauf zu. Wenn max_tokens nicht gesetzt ist, wird bei stream: true die Obergrenze eingesetzt, ohne Streaming ein kleinerer Standardwert.
Modelle mit Reasoning verwenden einen Teil von max_tokens für das Nachdenken vor der Antwort — lassen Sie Puffer.
model | Obergrenze | Standard, stream: true | Standard, ohne Streaming |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Dieselben Zahlen in maschinenlesbarer Form — in der Antwort von GET /v1/capabilities, Feld limits.models.
Standardmodell#
Eine Anfrage ohne das Feld model schickt das Gateway an das Standardmodell — derzeit ist das MiniMaxAI/MiniMax-M2.7.
Claude Code und das Anthropic SDK senden in /v1/messages Anthropic-Modellnamen (claude-*) — das Gateway ersetzt sie durch dasselbe Standardmodell.
Um mit einem anderen Modell zu arbeiten, geben Sie dessen Bezeichner aus der Tabelle oben an; im Installer ist das das Flag --model.
Zusammensetzung und Status über die API#
Die Zusammensetzung der Modelle ändert sich durch Abstimmungen im Gonka-Netzwerk — schreiben Sie die Liste nicht in den Code fest, sondern holen Sie sie aus der API. Für diese Anfragen ist kein Schlüssel nötig.
| Anfrage | Was zurückgegeben wird |
|---|---|
GET /v1/models | Derzeit verfügbare Modelle: Bezeichner, Kontext, Antwortlimit und Tokenpreis in Dollar. Ein Modell, das das Netzwerk gerade nicht bedient, fehlt in der Liste. |
GET /v1/models/{model} | Ein einzelnes Modell im selben Format. Den Schrägstrich im Bezeichner übergeben Sie wie er ist oder als %2F. Ein unbekanntes oder verborgenes Modell — 404 mit dem Code model_not_found, und eine Anfrage an ein verborgenes Modell erhält 503 model_unavailable. |
GET /v1/capabilities | Fähigkeiten des Gateways: Protokolle, Anfrageparameter und das Feld limits — das Anfragelimit des Schlüssels, Timeouts und max_tokens-Obergrenzen je Modell. |
GET /v1/network-status | Status jedes Modells und Vorfälle — dieselben Daten wie auf der Seite Netzwerkstatus. |
GET /health | Ob das Gateway selbst antwortet: {"status":"ok"}. Den Zustand der Modelle prüft diese Anfrage nicht. |