Pour les agents IA : guide de configuration étape par étape — /docs/agents.md, index de la documentation — /llms.txt.
Modèles
Les modèles du réseau Gonka disponibles via la passerelle : identifiant pour le champ model, fenêtre de contexte, limite de réponse, prix et statut.
Modèles et tarifs#
La liste des modèles évolue selon les votes du réseau Gonka, c'est pourquoi le tableau est construit à partir des données en direct de la passerelle. Les prix sont en dollars pour 1M de tokens au taux actuel du GNK ; le débit se fait en GNK, plus de détails dans la section Tarifs et compte.
| Modèle | Contexte | Réponse | Entrée, $/1M | Sortie, $/1M | Statut |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Dégradé |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Dégradé |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Opérationnel |
Insérez l'identifiant dans le champ model ; la casse n'a pas d'importance. Le statut est calculé selon la part de requêtes traitées avec succès, comme sur la page État du réseau.
Comment choisir un modèle#
- Vous ne savez pas par où commencer ? Prenez
MiniMaxAI/MiniMax-M2.7: les exemples de la documentation et les commandes de l'installateur sont basés dessus. - Le contexte le plus long —
zai-org/GLM-5.3-Flash: 390K tokens. Pour les grandes bases de code et les longs documents. - La réponse la plus longue —
deepseek-ai/DeepSeek-V4-Flash-0731: jusqu'à 33K tokens d'un coup. Pour générer de gros fichiers en entier.
Si le réseau cesse de servir un modèle, celui-ci disparaît de GET /v1/models, et les requêtes vers lui reçoivent une réponse 503 avec le type d'erreur model_unavailable. Le texte de l'erreur indiquera le modèle vers lequel basculer.
Longueur de la réponse#
La longueur de la réponse est définie par max_tokens — ou max_completion_tokens, la passerelle comprend les deux champs. Chaque modèle a un plafond : un max_tokens supérieur est silencieusement réduit à ce plafond par la passerelle. Si max_tokens n'est pas défini, avec stream: true le plafond est appliqué, et sans streaming — une valeur par défaut plus basse.
Les modèles avec raisonnement consomment une partie de max_tokens pour réfléchir avant de répondre — gardez une marge.
model | Plafond | Par défaut, stream: true | Par défaut, sans streaming |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Les mêmes chiffres en format machine — dans la réponse GET /v1/capabilities, champ limits.models.
Modèle par défaut#
Une requête sans le champ model est envoyée par la passerelle au modèle par défaut — actuellement MiniMaxAI/MiniMax-M2.7.
Claude Code et le SDK Anthropic envoient dans /v1/messages des noms de modèles Anthropic (claude-*) — la passerelle les remplace par le même modèle par défaut.
Pour travailler avec un autre modèle, indiquez son identifiant depuis le tableau ci-dessus ; dans l'installateur, c'est le flag --model.
Composition et statut via l'API#
La liste des modèles évolue selon les votes du réseau Gonka — ne codez pas la liste en dur, récupérez-la via l'API. Aucune clé n'est nécessaire pour ces requêtes.
| Requête | Ce qui est renvoyé |
|---|---|
GET /v1/models | Les modèles actuellement disponibles : identifiant, contexte, limite de réponse et prix du token en dollars. Un modèle que le réseau ne sert pas actuellement n'apparaît pas dans la liste. |
GET /v1/models/{model} | Un seul modèle dans le même format. Transmettez le slash dans l'identifiant tel quel ou comme %2F. Modèle inconnu ou masqué — 404 avec le code model_not_found, et une requête vers un modèle masqué reçoit 503 model_unavailable. |
GET /v1/capabilities | Capacités de la passerelle : protocoles, paramètres de requête et champ limits — limite de requêtes de la clé, timeouts et plafonds max_tokens par modèle. |
GET /v1/network-status | Statut de chaque modèle et incidents — les mêmes données que sur la page État du réseau. |
GET /health | Si la passerelle elle-même répond : {"status":"ok"}. Cette requête ne vérifie pas l'état des modèles. |