> Для ИИ-агентов: пошаговая инструкция по настройке — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), индекс документации — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Модели

Модели сети Gonka, доступные через шлюз: идентификатор для поля `model`, окно контекста, лимит ответа, цена и статус.

## Модели и цены

Состав моделей меняется голосованиями сети Gonka, поэтому таблица собирается из живых данных шлюза. Цены — в долларах за 1M токенов по текущему курсу GNK; списание идёт в GNK, подробнее — в разделе [Тарифы и аккаунт](https://gate.joingonka.ai/ru/docs/billing).

| Модель | Контекст | Ответ | Вход, `$/1M` | Выход, `$/1M` | Статус |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Снижение качества |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Снижение качества |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Работает |

Идентификатор вставляйте в поле `model`; регистр букв не важен. Статус считается по доле успешно обработанных запросов, как на странице [Статус сети](https://gate.joingonka.ai/ru/status).

## Как выбрать модель

- Не знаете, с чего начать, — берите `MiniMaxAI/MiniMax-M2.7`: на неё рассчитаны примеры документации и команды установщика.
- Самый длинный контекст — `zai-org/GLM-5.3-Flash`: 390K токенов. Для больших кодовых баз и длинных документов.
- Самый длинный ответ — `deepseek-ai/DeepSeek-V4-Flash-0731`: до 33K токенов за раз. Чтобы генерировать большие файлы целиком.

Если сеть перестаёт обслуживать модель, та пропадает из `GET /v1/models`, а запросы к ней получают ответ 503 с типом ошибки `model_unavailable`. В тексте ошибки будет модель, на которую можно переключиться.

## Длина ответа

Длину ответа задаёт `max_tokens` — или `max_completion_tokens`, шлюз понимает оба поля. У каждой модели есть потолок: больший `max_tokens` шлюз молча срезает до него. Если `max_tokens` не задан, при `stream: true` подставляется потолок, а без стрима — меньшее значение по умолчанию.

Модели с рассуждением тратят часть `max_tokens` на размышление до ответа — оставляйте запас.

| `model` | Потолок | По умолчанию, `stream: true` | По умолчанию, без стрима |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Те же числа в машинном виде — в ответе `GET /v1/capabilities`, поле `limits.models`.

## Модель по умолчанию

Запрос без поля `model` шлюз отправляет в модель по умолчанию — сейчас это `MiniMaxAI/MiniMax-M2.7`.

Claude Code и Anthropic SDK присылают в `/v1/messages` имена моделей Anthropic (`claude-*`) — шлюз заменяет их той же моделью по умолчанию.

Чтобы работать с другой моделью, укажите её идентификатор из таблицы выше; в установщике это флаг `--model`.

## Состав и статус через API

Состав моделей меняется голосованиями сети Gonka — не зашивайте список в код, берите его из API. Ключ для этих запросов не нужен.

| Запрос | Что возвращает |
| --- | --- |
| `GET /v1/models` | Модели, доступные сейчас: идентификатор, контекст, лимит ответа и цена токена в долларах. Модели, которую сеть сейчас не обслуживает, в списке нет. |
| `GET /v1/models/{model}` | Одна модель в том же формате. Слэш в идентификаторе передавайте как есть или как `%2F`. Неизвестная или скрытая модель — `404` с кодом `model_not_found`, а запрос к скрытой модели получает `503 model_unavailable`. |
| `GET /v1/capabilities` | Возможности шлюза: протоколы, параметры запроса и поле `limits` — лимит запросов ключа, таймауты и потолки `max_tokens` по моделям. |
| `GET /v1/network-status` | Статус каждой модели и инциденты — те же данные, что на странице [Статус сети](https://gate.joingonka.ai/ru/status). |
| `GET /health` | Отвечает ли сам шлюз: `{"status":"ok"}`. Состояние моделей этот запрос не проверяет. |
