> Pour les agents IA : guide de configuration étape par étape — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), index de la documentation — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Modèles

Les modèles du réseau Gonka disponibles via la passerelle : identifiant pour le champ `model`, fenêtre de contexte, limite de réponse, prix et statut.

## Modèles et tarifs

La liste des modèles évolue selon les votes du réseau Gonka, c'est pourquoi le tableau est construit à partir des données en direct de la passerelle. Les prix sont en dollars pour 1M de tokens au taux actuel du GNK ; le débit se fait en GNK, plus de détails dans la section [Tarifs et compte](https://gate.joingonka.ai/fr/docs/billing).

| Modèle | Contexte | Réponse | Entrée, `$/1M` | Sortie, `$/1M` | Statut |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Dégradé |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Dégradé |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Opérationnel |

Insérez l'identifiant dans le champ `model` ; la casse n'a pas d'importance. Le statut est calculé selon la part de requêtes traitées avec succès, comme sur la page [État du réseau](https://gate.joingonka.ai/fr/status).

## Comment choisir un modèle

- Vous ne savez pas par où commencer ? Prenez `MiniMaxAI/MiniMax-M2.7` : les exemples de la documentation et les commandes de l'installateur sont basés dessus.
- Le contexte le plus long — `zai-org/GLM-5.3-Flash` : 390K tokens. Pour les grandes bases de code et les longs documents.
- La réponse la plus longue — `deepseek-ai/DeepSeek-V4-Flash-0731` : jusqu'à 33K tokens d'un coup. Pour générer de gros fichiers en entier.

Si le réseau cesse de servir un modèle, celui-ci disparaît de `GET /v1/models`, et les requêtes vers lui reçoivent une réponse 503 avec le type d'erreur `model_unavailable`. Le texte de l'erreur indiquera le modèle vers lequel basculer.

## Longueur de la réponse

La longueur de la réponse est définie par `max_tokens` — ou `max_completion_tokens`, la passerelle comprend les deux champs. Chaque modèle a un plafond : un `max_tokens` supérieur est silencieusement réduit à ce plafond par la passerelle. Si `max_tokens` n'est pas défini, avec `stream: true` le plafond est appliqué, et sans streaming — une valeur par défaut plus basse.

Les modèles avec raisonnement consomment une partie de `max_tokens` pour réfléchir avant de répondre — gardez une marge.

| `model` | Plafond | Par défaut, `stream: true` | Par défaut, sans streaming |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Les mêmes chiffres en format machine — dans la réponse `GET /v1/capabilities`, champ `limits.models`.

## Modèle par défaut

Une requête sans le champ `model` est envoyée par la passerelle au modèle par défaut — actuellement `MiniMaxAI/MiniMax-M2.7`.

Claude Code et le SDK Anthropic envoient dans `/v1/messages` des noms de modèles Anthropic (`claude-*`) — la passerelle les remplace par le même modèle par défaut.

Pour travailler avec un autre modèle, indiquez son identifiant depuis le tableau ci-dessus ; dans l'installateur, c'est le flag `--model`.

## Composition et statut via l'API

La liste des modèles évolue selon les votes du réseau Gonka — ne codez pas la liste en dur, récupérez-la via l'API. Aucune clé n'est nécessaire pour ces requêtes.

| Requête | Ce qui est renvoyé |
| --- | --- |
| `GET /v1/models` | Les modèles actuellement disponibles : identifiant, contexte, limite de réponse et prix du token en dollars. Un modèle que le réseau ne sert pas actuellement n'apparaît pas dans la liste. |
| `GET /v1/models/{model}` | Un seul modèle dans le même format. Transmettez le slash dans l'identifiant tel quel ou comme `%2F`. Modèle inconnu ou masqué — `404` avec le code `model_not_found`, et une requête vers un modèle masqué reçoit `503 model_unavailable`. |
| `GET /v1/capabilities` | Capacités de la passerelle : protocoles, paramètres de requête et champ `limits` — limite de requêtes de la clé, timeouts et plafonds `max_tokens` par modèle. |
| `GET /v1/network-status` | Statut de chaque modèle et incidents — les mêmes données que sur la page [État du réseau](https://gate.joingonka.ai/fr/status). |
| `GET /health` | Si la passerelle elle-même répond : `{"status":"ok"}`. Cette requête ne vérifie pas l'état des modèles. |
