Оновлення та статус
Поточний стан інференсу та історія змін шлюзу.
Поточний статус
- MiniMax M2.7Мережа Gonka: Зниження продуктивності
- DeepSeek V4 FlashМережа Gonka: Зниження продуктивності
- GLM 5.3 FlashМережа Gonka: Працює
Набір активних моделей визначається голосуванням мережі Gonka та може змінюватися: частина моделей часом недоступна і повертається пізніше. Актуальний список — вище.
Детальний статус та аптайм →Історія оновлень
Баланс можна поповнити токеном WGNK — це GNK у мережі Ethereum. У кабінеті: Поповнити → GNK → Ethereum · WGNK; вкажіть адресу, з якої надішлете токени — переказ зарахується автоматично, зазвичай за 15–20 хвилин.
npx @joingonka/setup тепер налаштовує 25 інструментів. Нові: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush та Zoo Code. Модель обирається прапорцем --model (minimax, deepseek або glm), за замовчуванням — DeepSeek V4 Flash. Наприкінці інсталятор надсилає запит на перевірку і одразу показує, чи працює ключ.
З 16 вересня кожен новий акаунт отримує 100 000 000 nGNK (0,1 GNK) замість 50 000 000 — за поточною ціною мережі це близько 3 мільйонів токенів для тестів без поповнення. Бонус нараховується автоматично при реєстрації, нічого вводити не потрібно; актуальний розмір завжди видно у GET /api/pricing (поле welcome_bonus_ngonka) та на сторінці реєстрації.
Вузли мережі Gonka закривають будь-який стрім приблизно через 5 хвилин генерації (для GLM 5.3 Flash це близько 8 000 токенів). Раніше такий обрив виглядав як звичайне завершення: потік закінчувався [DONE] без finish_reason, і клієнт приймав уривок за цілу відповідь. Тепер шлюз досилає chunk з finish_reason="length" — і в стрімі, і в звичайній відповіді, а в форматі Anthropic це stop_reason="max_tokens". Що робити з довгими відповідями: використовуйте stream:true і при finish_reason="length" продовжуйте генерацію наступним запитом, передавши вже отриману частину в контексті. Подробиці — розділ «Ліміти» в документації.
У мережі Gonka з'явилася GLM 5.3 Flash від Z.ai: 320B параметрів (MoE, 18B активних), FP8, ліцензія MIT, контекст 390 000 токенів. Модель міркує перед відповіддю: міркування приходить у поле reasoning_content і витрачає бюджет відповіді, тому задавайте max_tokens не менше 600 або використовуйте stream:true; для коротких завдань — reasoning_effort: "low". Tool calling та JSON-режим працюють. Ідентифікатор — zai-org/GLM-5.3-Flash, ціна та ж, що у інших моделей мережі. Kimi K2.6 більше не обслуговується мережею — перемкніть інтеграції на MiniMax M2.7, DeepSeek V4 Flash або GLM 5.3 Flash.
Сторінка «Використання» показує витрати за кожною моделлю: запити, токени входу/виходу, вартість у nGNK та доларах, середню ціну за 1M токенів та швидкість відповіді. «Сьогодні» — погодинно, додано пресет «90 днів». Для інтеграцій — GET /api/usage/by-model.
Шлюз тепер приймає запити до /v1/completions — «текстового» ендпоінту OpenAI: на вхід приймається рядок prompt, на вихід — choices[].text. Його використовують редакторні плагіни для автодоповнення та інлайн-правки коду (Continue.dev та подібні). Base URL залишився незмінним: https://gate.joingonka.ai/v1. Підтримуються стрімінг та стандартні параметри (max_tokens, temperature, stop), вартість та ліміти такі ж, як у /v1/chat/completions. Поля logprobs та best_of не підтримуються.
З 22 серпня вартість інференсу: вхід — 33 nGNK, вихід — 99 nGNK за токен (попередні 22/66). Комісія шлюзу не змінюється — 10%. Демо-режим залишається безкоштовним. Чому зросло: запит у мережі Gonka обробляється з redundancy — це частина протоколу та коду devshards, потрібна для плавності обслуговування. Контейнер може надіслати запит одному хосту, потім іншому, якщо перший не впорався, а за необхідності — одразу кільком. Оплачується кожна спроба: ціна мережі 10 nGNK за токен, помножена на redundancy запиту (в середньому ×1—2.5). Раніше ця вартість до нас не доходила через непрацююче API фіналізації ціни, і ми платили як за один хост; тепер вона рахується фактично, і ми переносимо її в тариф. Інференс залишається в сотні разів дешевше за вендорські API. Актуальні ціни всіх моделей — сторінка Pricing та GET /api/pricing.
Шлюз приймає запити у форматі Responses — новому протоколі OpenAI, на який перейшли свіжі SDK і через який працює Codex CLI. Адреса колишня: base URL https://gate.joingonka.ai/v1, клієнт сам звернеться до /v1/responses. Працюють стрімінг, function tools та структуроване виведення (text.format), вартість і ліміти такі ж, як у /v1/chat/completions. Ми не зберігаємо діалоги, тому store ігнорується, а previous_response_id поверне помилку — передавайте всю історію в полі input. Вбудовані серверні інструменти OpenAI (web_search, file_search, code_interpreter) не підтримуються; наш веб-пошук, як і раніше, доступний через плагін web на /v1/chat/completions.
Раніше помилки мережі Gonka в режимі stream:true поверталися з кодом 200, а сама помилка була видна лише всередині SSE-chunk: клієнти агентів сприймали таку відповідь як порожню успішну і не робили повторний запит. Тепер, поки відповідь від мережі не почалася, помилка повертається звичайним HTTP-кодом — 429 при перевантаженні моделі (із заголовком Retry-After), 504 при таймауті, 503, якщо вільних node немає. Якщо помилка сталася вже посеред потоку, статус змінити не можна: там залишається chunk з полем error, але завершальний [DONE] більше не відправляється, щоб такий потік не виглядав як успішно завершений.
npx @joingonka/setup тепер налаштовує 15 агентних інструментів: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant та GitHub Copilot BYOK. Для семи з них конфіг записується та акуратно зливається з вашим (коментарі та налаштування користувача зберігаються), для решти, які налаштовуються лише через інтерфейс, друкуються готові значення для вставки. Потрібний інструмент можна вибрати відразу: npx @joingonka/setup --tool zed. Кожен запуск закінчується запитом до шлюзу, який підтверджує, що ключ, адреса та модель прийняті.
Максимальна довжина однієї відповіді для DeepSeek V4 Flash збільшена в 4 рази: з 8 192 до 32 768 токенів (параметр max_tokens). Великі файли та довгі відповіді від агентних інструментів тепер вміщуються в один виклик. Додатково: якщо відповідь все ж досягає ліміту посеред виклику інструменту, шлюз повертає коректний finish_reason="length" замість обірваного виклику — агентні клієнти (Cursor та інші) коректно продовжують роботу, а не зависають на помилці парсингу.
У мережі Gonka з'явилася третя активна модель — DeepSeek V4 Flash 0731: 380 000 токенів контексту (найдовший у мережі, перевірено реальним запитом на 381K), підтримка reasoning та tool calling. Ідентифікатор — deepseek-ai/DeepSeek-V4-Flash-0731, ціна така сама, як у інших моделей. Модель на етапі раннього тестування, але повністю доступна: вибирайте її в чаті дашборду або вказуйте в полі model вашого API-запиту.
З 3 серпня вартість інференсу: вхід — 22 nGNK, вихід — 66 nGNK за токен (удвічі вище за попередні 11/33). Комісія шлюзу не змінилася — 10%. Демо-режим залишається безкоштовним. Актуальні ціни всіх моделей — на сторінці Pricing та GET /api/pricing.
Якщо мережа Gonka приймає запит, але не відповідає (тайм-аут 300с), шлюз тепер одразу повертає помилку 504 замість серії мовчазних повторів. Важлива примітка щодо списання: запит, прийнятий мережею, неможливо скасувати — нода обробляє його в будь-якому разі, тому при тайм-ауті списується оцінка обробки промпту (completion не тарифікується). Рекомендація: для довгих генерацій використовуйте stream:true — стрім стійкіший до тайм-аутів і показує прогрес миттєво.
Комісія на поповнення через USDT тепер знижується зі зростанням суми: базова 5%, від $25 — 4.5%, від $50 — 4%, від $100 — 3.5%, від $250 — 3%, від $500 — 2.75%, від $1000 — 2.5%. У діалозі поповнення — інтерактивна драбинка: повзунок суми, бонус кожного ступеня в GNK та ваша економія. Знижка застосовується автоматично при зарахуванні.
Для дочірніх ключів можна встановити загальний (накопичувальний) ліміт витрат — виділену квоту, яка не скидається, на відміну від денного та місячного лімітів. При вичерпанні квоти запити за ключем відхиляються. Ліміт задається в дашборді (з точністю до nanogonka) або через API — поле limit_total_ngonka в POST/PATCH /api/management/keys/{id}/children; накопичена витрата скидається кнопкою «Reset usage» (або POST /api/management/keys/{id}/children/{childId}/reset-usage).
Вартість inferenced синхронізована з фактичною ціною мережі Gonka за токен. Ціни залишаються одними з найнижчих на ринку — частки цента за мільйон токенів, у сотні разів дешевше за OpenAI та Anthropic при тих самих open-source моделях. Вихідні токени (output tokens) тарифікуються дорожче за вхідні (input tokens) (×3), як у більшості провайдерів.
Підтвердили реальний ліміт контексту активних моделей — до 200 000 токенів (раніше публікувалися занижені 131 072). Можна надсилати довші документи та історії діалогу; актуальні характеристики кожної моделі — у розділі «Статус мережі».
Вартість кожного запиту видно в доларах — у відповіді API (поле usage.total_cost_usd) та в розділі «Використання». Зручно планувати витрати.
Налаштуйте доступ до API у своєму інструменті автоматично: виконайте npx @joingonka/setup. Підтримка Claude Code, OpenClaw, Cline, Continue, opencode, Aider та інших.
Модель шукає в інтернеті під час відповіді та додає посилання на джерела. Як увімкнути: передайте в тілі запиту plugins: [{ "id": "web", "max_results": 5 }] — працює в OpenAI- та Anthropic-сумісному API.
Максимальна довжина відповіді — до 8192 токенів; керуйте параметром max_tokens (за замовчуванням 1024 для потокової відповіді та 1500 для звичайної).
На сторінці «Чат» виберіть модель зі списку (завантажується з /v1/models) — вибір зберігається і застосовується до нових діалогів.
Потрібна швидкість? Додайте до запиту заголовок x-joingonka-meta: 1 — у потоковій відповіді прийдуть ttft_ms (час до першого токена) та tokens_per_sec.
Створіть керуючий ключ (POST /api/management/keys) та породжуйте дочірні ключі з лімітами (денна та місячна квота, rate limit, термін) через POST /api/management/keys/{id}/children.
Підключайте плагіни параметром plugins: response-healing лагодить обрізаний JSON, privacy-sanitization маскує приватні дані, file-parser витягує текст з PDF та документів.
OpenAI: base_url https://gate.joingonka.ai/v1, заголовок Authorization: Bearer ваш-ключ. Anthropic (Claude Code): base_url https://gate.joingonka.ai, заголовок x-api-key, endpoint /v1/messages.
GNK: отримайте адресу та memo і надішліть токени on-chain. USDT: вкажіть суму від 1 до 10 000 доларів і сплатіть через OxaPay — конвертація в GNK автоматична.