Для ШІ-агентів: покрокова інструкція з налаштування — /docs/agents.md, індекс документації — /llms.txt.
Моделі
Моделі мережі Gonka, доступні через шлюз: ідентифікатор для поля model, вікно контексту, ліміт відповіді, ціна та статус.
Моделі та ціни#
Склад моделей змінюється голосуваннями мережі Gonka, тому таблиця збирається з живих даних шлюзу. Ціни — у доларах за 1M токенів за поточним курсом GNK; списання йде в GNK, докладніше — у розділі Тарифи й акаунт.
| Модель | Контекст | Відповідь | Вхід, $/1M | Вихід, $/1M | Статус |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Зниження якості |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Зниження якості |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Працює |
Ідентифікатор вставляйте в поле model; регістр літер не важливий. Статус рахується за часткою успішно оброблених запитів, як на сторінці Статус мережі.
Як вибрати модель#
- Не знаєте, з чого почати, — беріть
MiniMaxAI/MiniMax-M2.7: на неї розраховані приклади документації та команди інсталятора. - Найдовший контекст —
zai-org/GLM-5.3-Flash: 390K токенів. Для великих кодових баз і довгих документів. - Найдовша відповідь —
deepseek-ai/DeepSeek-V4-Flash-0731: до 33K токенів за раз. Щоб генерувати великі файли цілком.
Якщо мережа перестає обслуговувати модель, вона зникає з GET /v1/models, а запити до неї отримують відповідь 503 із типом помилки model_unavailable. У тексті помилки буде модель, на яку можна переключитися.
Довжина відповіді#
Довжину відповіді задає max_tokens — або max_completion_tokens, шлюз розуміє обидва поля. У кожної моделі є стеля: більший max_tokens шлюз мовчки зрізає до неї. Якщо max_tokens не задано, при stream: true підставляється стеля, а без стріму — менше значення за замовчуванням.
Моделі з міркуванням витрачають частину max_tokens на роздуми до відповіді — залишайте запас.
model | Стеля | За замовчуванням, stream: true | За замовчуванням, без стріму |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Ті самі числа в машинному вигляді — у відповіді GET /v1/capabilities, поле limits.models.
Модель за замовчуванням#
Запит без поля model шлюз надсилає в модель за замовчуванням — нині це MiniMaxAI/MiniMax-M2.7.
Claude Code та Anthropic SDK надсилають у /v1/messages імена моделей Anthropic (claude-*) — шлюз замінює їх тією ж моделлю за замовчуванням.
Щоб працювати з іншою моделлю, вкажіть її ідентифікатор із таблиці вище; в інсталяторі це прапорець --model.
Склад і статус через API#
Склад моделей змінюється голосуваннями мережі Gonka — не вшивайте список у код, беріть його з API. Ключ для цих запитів не потрібен.
| Запит | Що повертає |
|---|---|
GET /v1/models | Моделі, доступні зараз: ідентифікатор, контекст, ліміт відповіді та ціна токена в доларах. Моделі, яку мережа зараз не обслуговує, у списку немає. |
GET /v1/models/{model} | Одна модель у тому ж форматі. Слеш в ідентифікаторі передавайте як є або як %2F. Невідома або прихована модель — 404 з кодом model_not_found, а запит до прихованої моделі отримує 503 model_unavailable. |
GET /v1/capabilities | Можливості шлюзу: протоколи, параметри запиту та поле limits — ліміт запитів ключа, таймаути й стелі max_tokens за моделями. |
GET /v1/network-status | Статус кожної моделі та інциденти — ті самі дані, що на сторінці Статус мережі. |
GET /health | Чи відповідає сам шлюз: {"status":"ok"}. Стан моделей цей запит не перевіряє. |