> Для ШІ-агентів: покрокова інструкція з налаштування — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), індекс документації — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# Моделі

Моделі мережі Gonka, доступні через шлюз: ідентифікатор для поля `model`, вікно контексту, ліміт відповіді, ціна та статус.

## Моделі та ціни

Склад моделей змінюється голосуваннями мережі Gonka, тому таблиця збирається з живих даних шлюзу. Ціни — у доларах за 1M токенів за поточним курсом GNK; списання йде в GNK, докладніше — у розділі [Тарифи й акаунт](https://gate.joingonka.ai/uk/docs/billing).

| Модель | Контекст | Відповідь | Вхід, `$/1M` | Вихід, `$/1M` | Статус |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | Зниження якості |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | Зниження якості |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | Працює |

Ідентифікатор вставляйте в поле `model`; регістр літер не важливий. Статус рахується за часткою успішно оброблених запитів, як на сторінці [Статус мережі](https://gate.joingonka.ai/uk/status).

## Як вибрати модель

- Не знаєте, з чого почати, — беріть `MiniMaxAI/MiniMax-M2.7`: на неї розраховані приклади документації та команди інсталятора.
- Найдовший контекст — `zai-org/GLM-5.3-Flash`: 390K токенів. Для великих кодових баз і довгих документів.
- Найдовша відповідь — `deepseek-ai/DeepSeek-V4-Flash-0731`: до 33K токенів за раз. Щоб генерувати великі файли цілком.

Якщо мережа перестає обслуговувати модель, вона зникає з `GET /v1/models`, а запити до неї отримують відповідь 503 із типом помилки `model_unavailable`. У тексті помилки буде модель, на яку можна переключитися.

## Довжина відповіді

Довжину відповіді задає `max_tokens` — або `max_completion_tokens`, шлюз розуміє обидва поля. У кожної моделі є стеля: більший `max_tokens` шлюз мовчки зрізає до неї. Якщо `max_tokens` не задано, при `stream: true` підставляється стеля, а без стріму — менше значення за замовчуванням.

Моделі з міркуванням витрачають частину `max_tokens` на роздуми до відповіді — залишайте запас.

| `model` | Стеля | За замовчуванням, `stream: true` | За замовчуванням, без стріму |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

Ті самі числа в машинному вигляді — у відповіді `GET /v1/capabilities`, поле `limits.models`.

## Модель за замовчуванням

Запит без поля `model` шлюз надсилає в модель за замовчуванням — нині це `MiniMaxAI/MiniMax-M2.7`.

Claude Code та Anthropic SDK надсилають у `/v1/messages` імена моделей Anthropic (`claude-*`) — шлюз замінює їх тією ж моделлю за замовчуванням.

Щоб працювати з іншою моделлю, вкажіть її ідентифікатор із таблиці вище; в інсталяторі це прапорець `--model`.

## Склад і статус через API

Склад моделей змінюється голосуваннями мережі Gonka — не вшивайте список у код, беріть його з API. Ключ для цих запитів не потрібен.

| Запит | Що повертає |
| --- | --- |
| `GET /v1/models` | Моделі, доступні зараз: ідентифікатор, контекст, ліміт відповіді та ціна токена в доларах. Моделі, яку мережа зараз не обслуговує, у списку немає. |
| `GET /v1/models/{model}` | Одна модель у тому ж форматі. Слеш в ідентифікаторі передавайте як є або як `%2F`. Невідома або прихована модель — `404` з кодом `model_not_found`, а запит до прихованої моделі отримує `503 model_unavailable`. |
| `GET /v1/capabilities` | Можливості шлюзу: протоколи, параметри запиту та поле `limits` — ліміт запитів ключа, таймаути й стелі `max_tokens` за моделями. |
| `GET /v1/network-status` | Статус кожної моделі та інциденти — ті самі дані, що на сторінці [Статус мережі](https://gate.joingonka.ai/uk/status). |
| `GET /health` | Чи відповідає сам шлюз: `{"status":"ok"}`. Стан моделей цей запит не перевіряє. |
