Pour les agents IA : guide de configuration étape par étape — /docs/agents.md, index de la documentation — /llms.txt.

Modèles

Les modèles du réseau Gonka disponibles via la passerelle : identifiant pour le champ model, fenêtre de contexte, limite de réponse, prix et statut.

Modèles et tarifs#

La liste des modèles évolue selon les votes du réseau Gonka, c'est pourquoi le tableau est construit à partir des données en direct de la passerelle. Les prix sont en dollars pour 1M de tokens au taux actuel du GNK ; le débit se fait en GNK, plus de détails dans la section Tarifs et compte.

ModèleContexteRéponseEntrée, $/1MSortie, $/1MStatut
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Dégradé
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Dégradé
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025Opérationnel

Insérez l'identifiant dans le champ model ; la casse n'a pas d'importance. Le statut est calculé selon la part de requêtes traitées avec succès, comme sur la page État du réseau.

Comment choisir un modèle#

  • Vous ne savez pas par où commencer ? Prenez MiniMaxAI/MiniMax-M2.7 : les exemples de la documentation et les commandes de l'installateur sont basés dessus.
  • Le contexte le plus long — zai-org/GLM-5.3-Flash : 390K tokens. Pour les grandes bases de code et les longs documents.
  • La réponse la plus longue — deepseek-ai/DeepSeek-V4-Flash-0731 : jusqu'à 33K tokens d'un coup. Pour générer de gros fichiers en entier.

Si le réseau cesse de servir un modèle, celui-ci disparaît de GET /v1/models, et les requêtes vers lui reçoivent une réponse 503 avec le type d'erreur model_unavailable. Le texte de l'erreur indiquera le modèle vers lequel basculer.

Longueur de la réponse#

La longueur de la réponse est définie par max_tokens — ou max_completion_tokens, la passerelle comprend les deux champs. Chaque modèle a un plafond : un max_tokens supérieur est silencieusement réduit à ce plafond par la passerelle. Si max_tokens n'est pas défini, avec stream: true le plafond est appliqué, et sans streaming — une valeur par défaut plus basse.

Les modèles avec raisonnement consomment une partie de max_tokens pour réfléchir avant de répondre — gardez une marge.

modelPlafondPar défaut, stream: truePar défaut, sans streaming
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Les mêmes chiffres en format machine — dans la réponse GET /v1/capabilities, champ limits.models.

Modèle par défaut#

Une requête sans le champ model est envoyée par la passerelle au modèle par défaut — actuellement MiniMaxAI/MiniMax-M2.7.

Claude Code et le SDK Anthropic envoient dans /v1/messages des noms de modèles Anthropic (claude-*) — la passerelle les remplace par le même modèle par défaut.

Pour travailler avec un autre modèle, indiquez son identifiant depuis le tableau ci-dessus ; dans l'installateur, c'est le flag --model.

Composition et statut via l'API#

La liste des modèles évolue selon les votes du réseau Gonka — ne codez pas la liste en dur, récupérez-la via l'API. Aucune clé n'est nécessaire pour ces requêtes.

RequêteCe qui est renvoyé
GET /v1/modelsLes modèles actuellement disponibles : identifiant, contexte, limite de réponse et prix du token en dollars. Un modèle que le réseau ne sert pas actuellement n'apparaît pas dans la liste.
GET /v1/models/{model}Un seul modèle dans le même format. Transmettez le slash dans l'identifiant tel quel ou comme %2F. Modèle inconnu ou masqué — 404 avec le code model_not_found, et une requête vers un modèle masqué reçoit 503 model_unavailable.
GET /v1/capabilitiesCapacités de la passerelle : protocoles, paramètres de requête et champ limits — limite de requêtes de la clé, timeouts et plafonds max_tokens par modèle.
GET /v1/network-statusStatut de chaque modèle et incidents — les mêmes données que sur la page État du réseau.
GET /healthSi la passerelle elle-même répond : {"status":"ok"}. Cette requête ne vérifie pas l'état des modèles.