Per gli agenti AI: guida passo passo alla configurazione — /docs/agents.md, indice della documentazione — /llms.txt.
Modelli
I modelli della rete Gonka disponibili tramite il gateway: identificatore per il campo model, finestra di contesto, limite di risposta, prezzo e stato.
Modelli e prezzi#
La composizione dei modelli cambia con le votazioni della rete Gonka, perciò la tabella viene costruita dai dati live del gateway. I prezzi sono in dollari per 1M di token al cambio GNK corrente; l'addebito avviene in GNK, per i dettagli vedi la sezione Piani e account.
| Modello | Contesto | Risposta | Input, $/1M | Output, $/1M | Stato |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Degradato |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Degradato |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Funzionante |
Inserisci l'identificatore nel campo model; maiuscole e minuscole non contano. Lo stato è calcolato sulla quota di richieste elaborate con successo, come nella pagina Stato della rete.
Come scegliere un modello#
- Non sai da dove iniziare? Scegli
MiniMaxAI/MiniMax-M2.7: gli esempi della documentazione e i comandi dell'installer sono tarati su di esso. - Il contesto più lungo —
zai-org/GLM-5.3-Flash: 390K token. Per codebase grandi e documenti lunghi. - La risposta più lunga —
deepseek-ai/DeepSeek-V4-Flash-0731: fino a 33K token in una volta. Per generare file grandi per intero.
Se la rete smette di servire un modello, questo sparisce da GET /v1/models e le richieste ricevono una risposta 503 con tipo di errore model_unavailable. Nel testo dell'errore sarà indicato il modello su cui è possibile passare.
Lunghezza della risposta#
La lunghezza della risposta è determinata da max_tokens — o da max_completion_tokens, il gateway capisce entrambi i campi. Ogni modello ha un tetto: un max_tokens superiore viene tagliato silenziosamente dal gateway fino a quel valore. Se max_tokens non è impostato, con stream: true viene applicato il tetto, mentre senza streaming un valore predefinito inferiore.
I modelli con ragionamento spendono parte dei max_tokens per riflettere prima di rispondere — lascia un margine.
model | Tetto | Predefinito, stream: true | Predefinito, senza streaming |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Gli stessi numeri in formato macchina — nella risposta GET /v1/capabilities, campo limits.models.
Modello predefinito#
Una richiesta senza il campo model viene inviata dal gateway al modello predefinito — attualmente MiniMaxAI/MiniMax-M2.7.
Claude Code e l'Anthropic SDK inviano in /v1/messages i nomi dei modelli Anthropic (claude-*) — il gateway li sostituisce con lo stesso modello predefinito.
Per lavorare con un altro modello, indica il suo identificatore dalla tabella qui sopra; nell'installer è il flag --model.
Composizione e stato via API#
La composizione dei modelli cambia con le votazioni della rete Gonka — non inserire la lista nel codice, prendila dall'API. Per queste richieste non serve la chiave.
| Richiesta | Cosa restituisce |
|---|---|
GET /v1/models | I modelli disponibili ora: identificatore, contesto, limite di risposta e prezzo del token in dollari. Un modello che la rete non sta servendo in questo momento non è nella lista. |
GET /v1/models/{model} | Un singolo modello nello stesso formato. Lo slash nell'identificatore va passato così com'è o come %2F. Modello sconosciuto o nascosto — 404 con codice model_not_found, mentre una richiesta a un modello nascosto riceve 503 model_unavailable. |
GET /v1/capabilities | Capacità del gateway: protocolli, parametri di richiesta e campo limits — limite di richieste della chiave, timeout e tetti max_tokens per modello. |
GET /v1/network-status | Lo stato di ogni modello e gli incidenti — gli stessi dati della pagina Stato della rete. |
GET /health | Se il gateway stesso risponde: {"status":"ok"}. Questa richiesta non verifica lo stato dei modelli. |