Для ШІ-агентів: покрокова інструкція з налаштування — /docs/agents.md, індекс документації — /llms.txt.

Моделі

Моделі мережі Gonka, доступні через шлюз: ідентифікатор для поля model, вікно контексту, ліміт відповіді, ціна та статус.

Моделі та ціни#

Склад моделей змінюється голосуваннями мережі Gonka, тому таблиця збирається з живих даних шлюзу. Ціни — у доларах за 1M токенів за поточним курсом GNK; списання йде в GNK, докладніше — у розділі Тарифи й акаунт.

МодельКонтекстВідповідьВхід, $/1MВихід, $/1MСтатус
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Зниження якості
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Зниження якості
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025Працює

Ідентифікатор вставляйте в поле model; регістр літер не важливий. Статус рахується за часткою успішно оброблених запитів, як на сторінці Статус мережі.

Як вибрати модель#

  • Не знаєте, з чого почати, — беріть MiniMaxAI/MiniMax-M2.7: на неї розраховані приклади документації та команди інсталятора.
  • Найдовший контекст — zai-org/GLM-5.3-Flash: 390K токенів. Для великих кодових баз і довгих документів.
  • Найдовша відповідь — deepseek-ai/DeepSeek-V4-Flash-0731: до 33K токенів за раз. Щоб генерувати великі файли цілком.

Якщо мережа перестає обслуговувати модель, вона зникає з GET /v1/models, а запити до неї отримують відповідь 503 із типом помилки model_unavailable. У тексті помилки буде модель, на яку можна переключитися.

Довжина відповіді#

Довжину відповіді задає max_tokens — або max_completion_tokens, шлюз розуміє обидва поля. У кожної моделі є стеля: більший max_tokens шлюз мовчки зрізає до неї. Якщо max_tokens не задано, при stream: true підставляється стеля, а без стріму — менше значення за замовчуванням.

Моделі з міркуванням витрачають частину max_tokens на роздуми до відповіді — залишайте запас.

modelСтеляЗа замовчуванням, stream: trueЗа замовчуванням, без стріму
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Ті самі числа в машинному вигляді — у відповіді GET /v1/capabilities, поле limits.models.

Модель за замовчуванням#

Запит без поля model шлюз надсилає в модель за замовчуванням — нині це MiniMaxAI/MiniMax-M2.7.

Claude Code та Anthropic SDK надсилають у /v1/messages імена моделей Anthropic (claude-*) — шлюз замінює їх тією ж моделлю за замовчуванням.

Щоб працювати з іншою моделлю, вкажіть її ідентифікатор із таблиці вище; в інсталяторі це прапорець --model.

Склад і статус через API#

Склад моделей змінюється голосуваннями мережі Gonka — не вшивайте список у код, беріть його з API. Ключ для цих запитів не потрібен.

ЗапитЩо повертає
GET /v1/modelsМоделі, доступні зараз: ідентифікатор, контекст, ліміт відповіді та ціна токена в доларах. Моделі, яку мережа зараз не обслуговує, у списку немає.
GET /v1/models/{model}Одна модель у тому ж форматі. Слеш в ідентифікаторі передавайте як є або як %2F. Невідома або прихована модель — 404 з кодом model_not_found, а запит до прихованої моделі отримує 503 model_unavailable.
GET /v1/capabilitiesМожливості шлюзу: протоколи, параметри запиту та поле limits — ліміт запитів ключа, таймаути й стелі max_tokens за моделями.
GET /v1/network-statusСтатус кожної моделі та інциденти — ті самі дані, що на сторінці Статус мережі.
GET /healthЧи відповідає сам шлюз: {"status":"ok"}. Стан моделей цей запит не перевіряє.