Per gli agenti AI: guida passo passo alla configurazione — /docs/agents.md, indice della documentazione — /llms.txt.

Modelli

I modelli della rete Gonka disponibili tramite il gateway: identificatore per il campo model, finestra di contesto, limite di risposta, prezzo e stato.

Modelli e prezzi#

La composizione dei modelli cambia con le votazioni della rete Gonka, perciò la tabella viene costruita dai dati live del gateway. I prezzi sono in dollari per 1M di token al cambio GNK corrente; l'addebito avviene in GNK, per i dettagli vedi la sezione Piani e account.

ModelloContestoRispostaInput, $/1MOutput, $/1MStato
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Degradato
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Degradato
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025Funzionante

Inserisci l'identificatore nel campo model; maiuscole e minuscole non contano. Lo stato è calcolato sulla quota di richieste elaborate con successo, come nella pagina Stato della rete.

Come scegliere un modello#

  • Non sai da dove iniziare? Scegli MiniMaxAI/MiniMax-M2.7: gli esempi della documentazione e i comandi dell'installer sono tarati su di esso.
  • Il contesto più lungo — zai-org/GLM-5.3-Flash: 390K token. Per codebase grandi e documenti lunghi.
  • La risposta più lunga — deepseek-ai/DeepSeek-V4-Flash-0731: fino a 33K token in una volta. Per generare file grandi per intero.

Se la rete smette di servire un modello, questo sparisce da GET /v1/models e le richieste ricevono una risposta 503 con tipo di errore model_unavailable. Nel testo dell'errore sarà indicato il modello su cui è possibile passare.

Lunghezza della risposta#

La lunghezza della risposta è determinata da max_tokens — o da max_completion_tokens, il gateway capisce entrambi i campi. Ogni modello ha un tetto: un max_tokens superiore viene tagliato silenziosamente dal gateway fino a quel valore. Se max_tokens non è impostato, con stream: true viene applicato il tetto, mentre senza streaming un valore predefinito inferiore.

I modelli con ragionamento spendono parte dei max_tokens per riflettere prima di rispondere — lascia un margine.

modelTettoPredefinito, stream: truePredefinito, senza streaming
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Gli stessi numeri in formato macchina — nella risposta GET /v1/capabilities, campo limits.models.

Modello predefinito#

Una richiesta senza il campo model viene inviata dal gateway al modello predefinito — attualmente MiniMaxAI/MiniMax-M2.7.

Claude Code e l'Anthropic SDK inviano in /v1/messages i nomi dei modelli Anthropic (claude-*) — il gateway li sostituisce con lo stesso modello predefinito.

Per lavorare con un altro modello, indica il suo identificatore dalla tabella qui sopra; nell'installer è il flag --model.

Composizione e stato via API#

La composizione dei modelli cambia con le votazioni della rete Gonka — non inserire la lista nel codice, prendila dall'API. Per queste richieste non serve la chiave.

RichiestaCosa restituisce
GET /v1/modelsI modelli disponibili ora: identificatore, contesto, limite di risposta e prezzo del token in dollari. Un modello che la rete non sta servendo in questo momento non è nella lista.
GET /v1/models/{model}Un singolo modello nello stesso formato. Lo slash nell'identificatore va passato così com'è o come %2F. Modello sconosciuto o nascosto — 404 con codice model_not_found, mentre una richiesta a un modello nascosto riceve 503 model_unavailable.
GET /v1/capabilitiesCapacità del gateway: protocolli, parametri di richiesta e campo limits — limite di richieste della chiave, timeout e tetti max_tokens per modello.
GET /v1/network-statusLo stato di ogni modello e gli incidenti — gli stessi dati della pagina Stato della rete.
GET /healthSe il gateway stesso risponde: {"status":"ok"}. Questa richiesta non verifica lo stato dei modelli.