> Per gli agenti AI: guida passo passo alla configurazione — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), indice della documentazione — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Modelli

I modelli della rete Gonka disponibili tramite il gateway: identificatore per il campo `model`, finestra di contesto, limite di risposta, prezzo e stato.

## Modelli e prezzi

La composizione dei modelli cambia con le votazioni della rete Gonka, perciò la tabella viene costruita dai dati live del gateway. I prezzi sono in dollari per 1M di token al cambio GNK corrente; l'addebito avviene in GNK, per i dettagli vedi la sezione [Piani e account](https://gate.joingonka.ai/it/docs/billing).

| Modello | Contesto | Risposta | Input, `$/1M` | Output, `$/1M` | Stato |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Degradato |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Degradato |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Funzionante |

Inserisci l'identificatore nel campo `model`; maiuscole e minuscole non contano. Lo stato è calcolato sulla quota di richieste elaborate con successo, come nella pagina [Stato della rete](https://gate.joingonka.ai/it/status).

## Come scegliere un modello

- Non sai da dove iniziare? Scegli `MiniMaxAI/MiniMax-M2.7`: gli esempi della documentazione e i comandi dell'installer sono tarati su di esso.
- Il contesto più lungo — `zai-org/GLM-5.3-Flash`: 390K token. Per codebase grandi e documenti lunghi.
- La risposta più lunga — `deepseek-ai/DeepSeek-V4-Flash-0731`: fino a 33K token in una volta. Per generare file grandi per intero.

Se la rete smette di servire un modello, questo sparisce da `GET /v1/models` e le richieste ricevono una risposta 503 con tipo di errore `model_unavailable`. Nel testo dell'errore sarà indicato il modello su cui è possibile passare.

## Lunghezza della risposta

La lunghezza della risposta è determinata da `max_tokens` — o da `max_completion_tokens`, il gateway capisce entrambi i campi. Ogni modello ha un tetto: un `max_tokens` superiore viene tagliato silenziosamente dal gateway fino a quel valore. Se `max_tokens` non è impostato, con `stream: true` viene applicato il tetto, mentre senza streaming un valore predefinito inferiore.

I modelli con ragionamento spendono parte dei `max_tokens` per riflettere prima di rispondere — lascia un margine.

| `model` | Tetto | Predefinito, `stream: true` | Predefinito, senza streaming |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Gli stessi numeri in formato macchina — nella risposta `GET /v1/capabilities`, campo `limits.models`.

## Modello predefinito

Una richiesta senza il campo `model` viene inviata dal gateway al modello predefinito — attualmente `MiniMaxAI/MiniMax-M2.7`.

Claude Code e l'Anthropic SDK inviano in `/v1/messages` i nomi dei modelli Anthropic (`claude-*`) — il gateway li sostituisce con lo stesso modello predefinito.

Per lavorare con un altro modello, indica il suo identificatore dalla tabella qui sopra; nell'installer è il flag `--model`.

## Composizione e stato via API

La composizione dei modelli cambia con le votazioni della rete Gonka — non inserire la lista nel codice, prendila dall'API. Per queste richieste non serve la chiave.

| Richiesta | Cosa restituisce |
| --- | --- |
| `GET /v1/models` | I modelli disponibili ora: identificatore, contesto, limite di risposta e prezzo del token in dollari. Un modello che la rete non sta servendo in questo momento non è nella lista. |
| `GET /v1/models/{model}` | Un singolo modello nello stesso formato. Lo slash nell'identificatore va passato così com'è o come `%2F`. Modello sconosciuto o nascosto — `404` con codice `model_not_found`, mentre una richiesta a un modello nascosto riceve `503 model_unavailable`. |
| `GET /v1/capabilities` | Capacità del gateway: protocolli, parametri di richiesta e campo `limits` — limite di richieste della chiave, timeout e tetti `max_tokens` per modello. |
| `GET /v1/network-status` | Lo stato di ogni modello e gli incidenti — gli stessi dati della pagina [Stato della rete](https://gate.joingonka.ai/it/status). |
| `GET /health` | Se il gateway stesso risponde: `{"status":"ok"}`. Questa richiesta non verifica lo stato dei modelli. |
