Обновления и статус

Текущее состояние инференса и история изменений шлюза.

Текущий статус

Сеть Gonka: снижение качества
Модели сети
  • MiniMax M2.7Сеть Gonka: снижение качества
  • DeepSeek V4 FlashСеть Gonka: снижение качества
  • GLM 5.3 FlashСеть Gonka: работает

Набор активных моделей определяется голосованием сети Gonka и может меняться: часть моделей временами недоступна и возвращается позже. Актуальный список — выше.

Подробный статус и аптайм →

История обновлений

сентябрь 2026 г.
Новое
Пополнение в WGNK из Ethereum23 сент.

Баланс можно пополнить токеном WGNK — это GNK в сети Ethereum. В кабинете: Пополнить → GNK → Ethereum · WGNK; укажите адрес, с которого отправите токены, — перевод зачислится автоматически, обычно за 15–20 минут.

Новое
Установщик: 25 инструментов21 сент.

npx @joingonka/setup теперь настраивает 25 инструментов. Новые: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush и Zoo Code. Модель выбирается флагом --model (minimax, deepseek или glm), по умолчанию — DeepSeek V4 Flash. В конце установщик отправляет проверочный запрос и сразу показывает, работает ли ключ.

Улучшение
Стартовый бонус удвоен: 100 000 000 nGNK новым аккаунтам16 сент.

С 16 сентября каждый новый аккаунт получает 100 000 000 nGNK (0,1 GNK) вместо 50 000 000 — по текущей цене сети это около 3 миллионов токенов для тестов без пополнения. Бонус начисляется автоматически при регистрации, ничего вводить не нужно; актуальный размер всегда виден в GET /api/pricing (поле welcome_bonus_ngonka) и на странице регистрации.

Улучшение
Обрыв длинной генерации — честный finish_reason=length16 сент.

Брокеры сети Gonka закрывают любой стрим примерно через 5 минут генерации (для GLM 5.3 Flash это около 8 000 токенов). Раньше такой обрыв выглядел как обычное завершение: поток заканчивался [DONE] без finish_reason, и клиент принимал обрубок за целый ответ. Теперь шлюз досылает чанк с finish_reason="length" — и в стриме, и в обычном ответе, а в Anthropic-формате это stop_reason="max_tokens". Что делать с длинными ответами: используйте stream:true и при finish_reason="length" продолжайте генерацию следующим запросом, передав уже полученную часть в контексте. Подробности — раздел «Лимиты» в документации.

Новое
Новая модель: GLM 5.3 Flash — reasoning от Z.ai16 сент.

В сети Gonka появилась GLM 5.3 Flash от Z.ai: 320B параметров (MoE, 18B активных), FP8, лицензия MIT, контекст 390 000 токенов. Модель рассуждает перед ответом: рассуждение приходит в поле reasoning_content и расходует бюджет ответа, поэтому задавайте max_tokens не меньше 600 или используйте stream:true; для коротких задач — reasoning_effort: "low". Tool calling и JSON-режим работают. Идентификатор — zai-org/GLM-5.3-Flash, цена та же, что у остальных моделей сети. Kimi K2.6 больше не обслуживается сетью — переключите интеграции на MiniMax M2.7, DeepSeek V4 Flash или GLM 5.3 Flash.

Новое
Статистика использования по моделям15 сент.

Страница «Использование» показывает расход по каждой модели: запросы, токены вход/выход, стоимость в nGNK и долларах, среднюю цену за 1M токенов и скорость ответа. «Сегодня» — по часам, добавлен пресет «90 дней». Для интеграций — GET /api/usage/by-model.

август 2026 г.
Новое
Поддержка legacy OpenAI Completions24 авг.

Шлюз принимает запросы на /v1/completions — «текстовый» эндпоинт OpenAI: на вход строка prompt, на выход choices[].text. К нему обращаются редакторные плагины за автодополнением и inline-правкой кода (Continue.dev и подобные). Base URL прежний: https://gate.joingonka.ai/v1. Работают стриминг и обычные параметры (max_tokens, temperature, stop), стоимость и лимиты те же, что у /v1/chat/completions. Полей logprobs и best_of нет.

Улучшение
Обновление тарифов инференса22 авг.

С 22 августа стоимость инференса: вход — 33 nGNK, выход — 99 nGNK за токен (прежние 22/66). Комиссия шлюза не меняется — 10%. Демо-режим остаётся бесплатным. Почему выросло: запрос в сети Gonka обрабатывается с избыточностью (redundancy) — это часть протокола и кода devshards, нужная для плавности обслуживания. Контейнер может отправить запрос одному хосту, затем другому, если первый не справился, а при необходимости — сразу нескольким. Оплачивается каждая попытка: цена сети 10 nGNK за токен, умноженная на redundancy запроса (в среднем ×1—2.5). Раньше эта стоимость до нас не доходила из-за неработавшего API финализации цены, и мы платили как за один хост; теперь она считается фактически, и мы переносим её в тариф. Инференс остаётся в сотни раз дешевле вендорских API. Актуальные цены всех моделей — страница Pricing и GET /api/pricing.

Новое
Поддержка OpenAI Responses API22 авг.

Шлюз принимает запросы в формате Responses — новом протоколе OpenAI, на который перешли свежие SDK и через который работает Codex CLI. Адрес прежний: base URL https://gate.joingonka.ai/v1, клиент сам обратится к /v1/responses. Работают стриминг, function tools и структурированный вывод (text.format), стоимость и лимиты те же, что у /v1/chat/completions. Диалоги мы не храним, поэтому store игнорируется, а previous_response_id вернёт ошибку — передавайте всю историю в поле input. Встроенные серверные инструменты OpenAI (web_search, file_search, code_interpreter) не поддерживаются; наш веб-поиск по-прежнему доступен плагином web на /v1/chat/completions.

Исправление
Ошибки стрима — честным HTTP-кодом20 авг.

Раньше сбой сети Gonka в режиме stream:true приходил с кодом 200, а сама ошибка была видна только внутри SSE-чанка: агентные клиенты принимали такой ответ за пустой успешный и не делали повтор. Теперь, пока ответ от сети не начался, ошибка отдаётся обычным HTTP-кодом — 429 при перегрузке модели (с заголовком Retry-After), 504 при таймауте, 503 если свободных нод не осталось. Если сбой произошёл уже в середине потока, статус изменить нельзя: там по-прежнему чанк с полем error, но завершающий [DONE] больше не отправляется, чтобы такой поток не выглядел нормально завершённым.

Новое
Установщик: 15 инструментов одной командой20 авг.

npx @joingonka/setup теперь настраивает 15 агентных инструментов: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant и GitHub Copilot BYOK. Семи из них конфиг пишется и аккуратно сливается с вашим (комментарии и чужие настройки сохраняются), остальным — тем, что настраиваются только через интерфейс, — печатаются готовые значения для вставки. Нужный инструмент можно выбрать сразу: npx @joingonka/setup --tool zed. Каждый запуск заканчивается живым запросом к шлюзу, который подтверждает, что ключ, адрес и модель приняты.

Улучшение
Лимит ответа DeepSeek — 32 768 токенов17 авг.

Максимальная длина одного ответа для DeepSeek V4 Flash увеличена в 4 раза: с 8 192 до 32 768 токенов (параметр max_tokens). Большие файлы и длинные ответы агентных инструментов теперь помещаются в один вызов. Дополнительно: если ответ всё же упирается в лимит посреди вызова инструмента, шлюз возвращает честный finish_reason="length" вместо оборванного вызова — агентные клиенты (Cursor и другие) корректно продолжают работу, а не зависают на ошибке разбора.

Новое
Новая модель: DeepSeek V4 Flash с контекстом 380K13 авг.

В сети Gonka появилась третья действующая модель — DeepSeek V4 Flash 0731: контекст 380 000 токенов (самый длинный в сети, проверен реальным запросом на 381K), reasoning и tool calling. Идентификатор — deepseek-ai/DeepSeek-V4-Flash-0731, цена та же, что у остальных моделей. Модель в раннем тестировании, но полностью доступна: выбирайте её в чате дашборда или указывайте в поле model вашего API-запроса.

Улучшение
Обновление тарифов инференса3 авг.

С 3 августа стоимость инференса: вход — 22 nGNK, выход — 66 nGNK за токен (вдвое выше прежних 11/33). Комиссия шлюза не изменилась — 10%. Демо-режим остаётся бесплатным. Актуальные цены всех моделей — страница Pricing и GET /api/pricing.

июль 2026 г.
Улучшение
Честные таймауты: быстрый 504 вместо 5-минутного зависания23 июл.

Если сеть Gonka принимает запрос, но не отвечает (таймаут 300с), шлюз теперь сразу возвращает ошибку 504 вместо серии молчаливых повторов. Важно про списание: принятый сетью запрос отменить невозможно — нода обрабатывает его в любом случае, поэтому при таймауте списывается оценка обработки промпта (completion не тарифицируется). Рекомендация: для длинных генераций используйте stream:true — стрим устойчивее к таймаутам и показывает прогресс сразу.

Новое
Лесенка комиссии на USDT-пополнение — до −50%9 июл.

Комиссия на пополнение через USDT теперь снижается с ростом суммы: базовые 5%, от $25 — 4.5%, от $50 — 4%, от $100 — 3.5%, от $250 — 3%, от $500 — 2.75%, от $1000 — 2.5%. В диалоге пополнения — интерактивная лесенка: ползунок суммы, бонус каждой ступени в GNK и ваша экономия. Скидка применяется автоматически при зачислении.

июнь 2026 г.
Новое
Общий лимит расхода на ключ28 июн.

Для дочерних ключей можно задать общий (накопительный) лимит расхода — выделенную квоту, которая не сбрасывается, в отличие от дневного и месячного лимитов. При исчерпании квоты запросы по ключу отклоняются. Лимит задаётся в дашборде (с точностью до наногонки) или через API — поле limit_total_ngonka в POST/PATCH /api/management/keys/{id}/children; накопленный расход обнуляется кнопкой «Сбросить расход» (или POST /api/management/keys/{id}/children/{childId}/reset-usage).

Улучшение
Тарификация — по реальной цене сети27 июн.

Стоимость инференса синхронизирована с фактической ценой сети Gonka за токен. Цены остаются одними из самых низких на рынке — доли цента за миллион токенов, в сотни раз дешевле OpenAI и Anthropic при тех же open-source моделях. Выходные токены тарифицируются дороже входных (×3), как у большинства провайдеров.

Улучшение
Контекст до 200 000 токенов27 июн.

Подтвердили реальный лимит контекста активных моделей — до 200 000 токенов (раньше публиковались заниженные 131 072). Можно отправлять более длинные документы и истории диалога; актуальные характеристики каждой модели — в разделе «Статус сети».

Улучшение
Стоимость запросов в долларах23 июн.

Стоимость каждого запроса видна в долларах — в ответе API (поле usage.total_cost_usd) и в разделе «Использование». Удобно планировать расходы.

Новое
Подключение одной командой23 июн.

Настройте доступ к API в своём инструменте автоматически: выполните npx @joingonka/setup. Поддержка Claude Code, OpenClaw, Cline, Continue, opencode, Aider и других.

Новое
Веб-поиск в реальном времени17 июн.

Модель ищет в интернете во время ответа и добавляет ссылки на источники. Как включить: передайте в теле запроса plugins: [{ "id": "web", "max_results": 5 }] — работает в OpenAI- и Anthropic-совместимом API.

май 2026 г.
Улучшение
Длинные ответы до 8192 токенов25 мая

Максимальная длина ответа — до 8192 токенов; управляйте параметром max_tokens (по умолчанию 1024 для потокового ответа и 1500 для обычного).

Новое
Выбор модели в чате5 мая

На странице «Чат» выберите модель из списка (загружается из /v1/models) — выбор сохраняется и применяется к новым диалогам.

Улучшение
Метрики скорости ответа5 мая

Нужна скорость? Добавьте к запросу заголовок x-joingonka-meta: 1 — в потоковом ответе придут ttft_ms (время до первого токена) и tokens_per_sec.

март 2026 г.
Новое
Управляющие ключи для перепродажи24 мар.

Создайте управляющий ключ (POST /api/management/keys) и порождайте дочерние ключи с лимитами (дневная и месячная квота, rate limit, срок) через POST /api/management/keys/{id}/children.

Новое
Плагины обработки запросов24 мар.

Подключайте плагины параметром plugins: response-healing чинит обрезанный JSON, privacy-sanitization маскирует приватные данные, file-parser извлекает текст из PDF и документов.

Новое
OpenAI- и Anthropic-совместимый API19 мар.

OpenAI: base_url https://gate.joingonka.ai/v1, заголовок Authorization: Bearer ваш-ключ. Anthropic (Claude Code): base_url https://gate.joingonka.ai, заголовок x-api-key, endpoint /v1/messages.

Новое
Пополнение в GNK и USDT18 мар.

GNK: получите адрес и memo и отправьте токены on-chain. USDT: укажите сумму от 1 до 10 000 долларов и оплатите через OxaPay — конвертация в GNK автоматическая.