Для ИИ-агентов: пошаговая инструкция по настройке — /docs/agents.md, индекс документации — /llms.txt.
Модели
Модели сети Gonka, доступные через шлюз: идентификатор для поля model, окно контекста, лимит ответа, цена и статус.
Модели и цены#
Состав моделей меняется голосованиями сети Gonka, поэтому таблица собирается из живых данных шлюза. Цены — в долларах за 1M токенов по текущему курсу GNK; списание идёт в GNK, подробнее — в разделе Тарифы и аккаунт.
| Модель | Контекст | Ответ | Вход, $/1M | Выход, $/1M | Статус |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | Снижение качества |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | Снижение качества |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | Работает |
Идентификатор вставляйте в поле model; регистр букв не важен. Статус считается по доле успешно обработанных запросов, как на странице Статус сети.
Как выбрать модель#
- Не знаете, с чего начать, — берите
MiniMaxAI/MiniMax-M2.7: на неё рассчитаны примеры документации и команды установщика. - Самый длинный контекст —
zai-org/GLM-5.3-Flash: 390K токенов. Для больших кодовых баз и длинных документов. - Самый длинный ответ —
deepseek-ai/DeepSeek-V4-Flash-0731: до 33K токенов за раз. Чтобы генерировать большие файлы целиком.
Если сеть перестаёт обслуживать модель, та пропадает из GET /v1/models, а запросы к ней получают ответ 503 с типом ошибки model_unavailable. В тексте ошибки будет модель, на которую можно переключиться.
Длина ответа#
Длину ответа задаёт max_tokens — или max_completion_tokens, шлюз понимает оба поля. У каждой модели есть потолок: больший max_tokens шлюз молча срезает до него. Если max_tokens не задан, при stream: true подставляется потолок, а без стрима — меньшее значение по умолчанию.
Модели с рассуждением тратят часть max_tokens на размышление до ответа — оставляйте запас.
model | Потолок | По умолчанию, stream: true | По умолчанию, без стрима |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
Те же числа в машинном виде — в ответе GET /v1/capabilities, поле limits.models.
Модель по умолчанию#
Запрос без поля model шлюз отправляет в модель по умолчанию — сейчас это MiniMaxAI/MiniMax-M2.7.
Claude Code и Anthropic SDK присылают в /v1/messages имена моделей Anthropic (claude-*) — шлюз заменяет их той же моделью по умолчанию.
Чтобы работать с другой моделью, укажите её идентификатор из таблицы выше; в установщике это флаг --model.
Состав и статус через API#
Состав моделей меняется голосованиями сети Gonka — не зашивайте список в код, берите его из API. Ключ для этих запросов не нужен.
| Запрос | Что возвращает |
|---|---|
GET /v1/models | Модели, доступные сейчас: идентификатор, контекст, лимит ответа и цена токена в долларах. Модели, которую сеть сейчас не обслуживает, в списке нет. |
GET /v1/models/{model} | Одна модель в том же формате. Слэш в идентификаторе передавайте как есть или как %2F. Неизвестная или скрытая модель — 404 с кодом model_not_found, а запрос к скрытой модели получает 503 model_unavailable. |
GET /v1/capabilities | Возможности шлюза: протоколы, параметры запроса и поле limits — лимит запросов ключа, таймауты и потолки max_tokens по моделям. |
GET /v1/network-status | Статус каждой модели и инциденты — те же данные, что на странице Статус сети. |
GET /health | Отвечает ли сам шлюз: {"status":"ok"}. Состояние моделей этот запрос не проверяет. |