> Für KI-Agenten: Schritt-für-Schritt-Anleitung zur Einrichtung — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), Dokumentationsindex — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Modelle

Die über das Gateway verfügbaren Modelle des Gonka-Netzwerks: Bezeichner für das Feld `model`, Kontextfenster, Antwortlimit, Preis und Status.

## Modelle und Preise

Die Zusammensetzung der Modelle ändert sich durch Abstimmungen im Gonka-Netzwerk, daher wird die Tabelle aus Live-Daten des Gateways erstellt. Preise in Dollar pro 1M Tokens zum aktuellen GNK-Kurs; abgebucht wird in GNK, mehr dazu im Abschnitt [Tarife und Konto](https://gate.joingonka.ai/de/docs/billing).

| Modell | Kontext | Antwort | Eingabe, `$/1M` | Ausgabe, `$/1M` | Status |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Beeinträchtigt |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Beeinträchtigt |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | In Betrieb |

Den Bezeichner tragen Sie in das Feld `model` ein; die Groß-/Kleinschreibung spielt keine Rolle. Der Status wird anhand des Anteils erfolgreich verarbeiteter Anfragen berechnet, wie auf der Seite [Netzwerkstatus](https://gate.joingonka.ai/de/status).

## Wie wählt man ein Modell aus

- Wenn Sie nicht wissen, wo Sie anfangen sollen, nehmen Sie `MiniMaxAI/MiniMax-M2.7`: darauf sind die Dokumentationsbeispiele und Installer-Befehle ausgelegt.
- Der längste Kontext — `zai-org/GLM-5.3-Flash`: 390K Tokens. Für große Codebasen und lange Dokumente.
- Die längste Antwort — `deepseek-ai/DeepSeek-V4-Flash-0731`: bis zu 33K Tokens auf einmal. Um große Dateien vollständig zu generieren.

Wenn das Netzwerk ein Modell nicht mehr bedient, verschwindet es aus `GET /v1/models`, und Anfragen an dasselbe erhalten die Antwort 503 mit dem Fehlertyp `model_unavailable`. Im Fehlertext steht das Modell, auf das Sie wechseln können.

## Antwortlänge

Die Antwortlänge bestimmt `max_tokens` — oder `max_completion_tokens`, das Gateway versteht beide Felder. Jedes Modell hat eine Obergrenze: ein größeres `max_tokens` schneidet das Gateway stillschweigend darauf zu. Wenn `max_tokens` nicht gesetzt ist, wird bei `stream: true` die Obergrenze eingesetzt, ohne Streaming ein kleinerer Standardwert.

Modelle mit Reasoning verwenden einen Teil von `max_tokens` für das Nachdenken vor der Antwort — lassen Sie Puffer.

| `model` | Obergrenze | Standard, `stream: true` | Standard, ohne Streaming |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Dieselben Zahlen in maschinenlesbarer Form — in der Antwort von `GET /v1/capabilities`, Feld `limits.models`.

## Standardmodell

Eine Anfrage ohne das Feld `model` schickt das Gateway an das Standardmodell — derzeit ist das `MiniMaxAI/MiniMax-M2.7`.

Claude Code und das Anthropic SDK senden in `/v1/messages` Anthropic-Modellnamen (`claude-*`) — das Gateway ersetzt sie durch dasselbe Standardmodell.

Um mit einem anderen Modell zu arbeiten, geben Sie dessen Bezeichner aus der Tabelle oben an; im Installer ist das das Flag `--model`.

## Zusammensetzung und Status über die API

Die Zusammensetzung der Modelle ändert sich durch Abstimmungen im Gonka-Netzwerk — schreiben Sie die Liste nicht in den Code fest, sondern holen Sie sie aus der API. Für diese Anfragen ist kein Schlüssel nötig.

| Anfrage | Was zurückgegeben wird |
| --- | --- |
| `GET /v1/models` | Derzeit verfügbare Modelle: Bezeichner, Kontext, Antwortlimit und Tokenpreis in Dollar. Ein Modell, das das Netzwerk gerade nicht bedient, fehlt in der Liste. |
| `GET /v1/models/{model}` | Ein einzelnes Modell im selben Format. Den Schrägstrich im Bezeichner übergeben Sie wie er ist oder als `%2F`. Ein unbekanntes oder verborgenes Modell — `404` mit dem Code `model_not_found`, und eine Anfrage an ein verborgenes Modell erhält `503 model_unavailable`. |
| `GET /v1/capabilities` | Fähigkeiten des Gateways: Protokolle, Anfrageparameter und das Feld `limits` — das Anfragelimit des Schlüssels, Timeouts und `max_tokens`-Obergrenzen je Modell. |
| `GET /v1/network-status` | Status jedes Modells und Vorfälle — dieselben Daten wie auf der Seite [Netzwerkstatus](https://gate.joingonka.ai/de/status). |
| `GET /health` | Ob das Gateway selbst antwortet: `{"status":"ok"}`. Den Zustand der Modelle prüft diese Anfrage nicht. |
