Для ИИ-агентов: пошаговая инструкция по настройке — /docs/agents.md, индекс документации — /llms.txt.

Модели

Модели сети Gonka, доступные через шлюз: идентификатор для поля model, окно контекста, лимит ответа, цена и статус.

Модели и цены#

Состав моделей меняется голосованиями сети Gonka, поэтому таблица собирается из живых данных шлюза. Цены — в долларах за 1M токенов по текущему курсу GNK; списание идёт в GNK, подробнее — в разделе Тарифы и аккаунт.

МодельКонтекстОтветВход, $/1MВыход, $/1MСтатус
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025Снижение качества
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025Снижение качества
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025Работает

Идентификатор вставляйте в поле model; регистр букв не важен. Статус считается по доле успешно обработанных запросов, как на странице Статус сети.

Как выбрать модель#

  • Не знаете, с чего начать, — берите MiniMaxAI/MiniMax-M2.7: на неё рассчитаны примеры документации и команды установщика.
  • Самый длинный контекст — zai-org/GLM-5.3-Flash: 390K токенов. Для больших кодовых баз и длинных документов.
  • Самый длинный ответ — deepseek-ai/DeepSeek-V4-Flash-0731: до 33K токенов за раз. Чтобы генерировать большие файлы целиком.

Если сеть перестаёт обслуживать модель, та пропадает из GET /v1/models, а запросы к ней получают ответ 503 с типом ошибки model_unavailable. В тексте ошибки будет модель, на которую можно переключиться.

Длина ответа#

Длину ответа задаёт max_tokens — или max_completion_tokens, шлюз понимает оба поля. У каждой модели есть потолок: больший max_tokens шлюз молча срезает до него. Если max_tokens не задан, при stream: true подставляется потолок, а без стрима — меньшее значение по умолчанию.

Модели с рассуждением тратят часть max_tokens на размышление до ответа — оставляйте запас.

modelПотолокПо умолчанию, stream: trueПо умолчанию, без стрима
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

Те же числа в машинном виде — в ответе GET /v1/capabilities, поле limits.models.

Модель по умолчанию#

Запрос без поля model шлюз отправляет в модель по умолчанию — сейчас это MiniMaxAI/MiniMax-M2.7.

Claude Code и Anthropic SDK присылают в /v1/messages имена моделей Anthropic (claude-*) — шлюз заменяет их той же моделью по умолчанию.

Чтобы работать с другой моделью, укажите её идентификатор из таблицы выше; в установщике это флаг --model.

Состав и статус через API#

Состав моделей меняется голосованиями сети Gonka — не зашивайте список в код, берите его из API. Ключ для этих запросов не нужен.

ЗапросЧто возвращает
GET /v1/modelsМодели, доступные сейчас: идентификатор, контекст, лимит ответа и цена токена в долларах. Модели, которую сеть сейчас не обслуживает, в списке нет.
GET /v1/models/{model}Одна модель в том же формате. Слэш в идентификаторе передавайте как есть или как %2F. Неизвестная или скрытая модель — 404 с кодом model_not_found, а запрос к скрытой модели получает 503 model_unavailable.
GET /v1/capabilitiesВозможности шлюза: протоколы, параметры запроса и поле limits — лимит запросов ключа, таймауты и потолки max_tokens по моделям.
GET /v1/network-statusСтатус каждой модели и инциденты — те же данные, что на странице Статус сети.
GET /healthОтвечает ли сам шлюз: {"status":"ok"}. Состояние моделей этот запрос не проверяет.