Atualizações e status

Estado atual do inferenced e histórico de alterações do gateway.

Status atual

Rede Gonka: Operacional
Modelos da rede
  • MiniMax M2.7Rede Gonka: Operacional
  • Kimi K2.6Rede Gonka: Operacional
  • DeepSeek V4 FlashRede Gonka: Operacional

O conjunto de modelos ativos é definido pela votação da rede Gonka e pode mudar: alguns modelos ficam indisponíveis temporariamente e retornam depois. A lista atual está acima.

Status detalhado e uptime →

Histórico de atualizações

agosto de 2026
Melhoria
Limite de resposta do DeepSeek — 32.768 tokens17 de ago.

O comprimento máximo de uma resposta única para o DeepSeek V4 Flash foi aumentado em 4 vezes: de 8.192 para 32.768 tokens (parâmetro max_tokens). Arquivos grandes e respostas longas de ferramentas de agente agora cabem em uma única chamada. Adicionalmente: se a resposta atingir o limite no meio de uma chamada de ferramenta, o gateway retorna um finish_reason="length" honesto em vez de uma chamada truncada — clientes de agente (Cursor e outros) continuam funcionando corretamente em vez de travar por erro de análise.

Novo
Novo modelo: DeepSeek V4 Flash com contexto de 380K13 de ago.

Um terceiro modelo ativo surgiu na rede Gonka — DeepSeek V4 Flash 0731: contexto de 380.000 tokens (o maior da rede, verificado por uma requisição real de 381K), reasoning e tool calling. O identificador é deepseek-ai/DeepSeek-V4-Flash-0731, o preço é o mesmo dos outros modelos. O modelo está em testes iniciais, mas totalmente disponível: selecione-o no chat do dashboard ou especifique no campo model da sua requisição de API.

Melhoria
Atualização de preços de inferência3 de ago.

A partir de 3 de agosto, o custo de inferência é: entrada — 22 nGNK, saída — 66 nGNK por token (o dobro dos 11/33 anteriores). A taxa do gateway permanece inalterada em 10%. O modo demo continua gratuito. Os preços atuais de todos os modelos estão na página Pricing e no GET /api/pricing.

julho de 2026
Melhoria
Timeouts justos: 504 rápido em vez de um travamento de 5 minutos23 de jul.

Se a rede Gonka recebe uma solicitação mas não responde (timeout de 300s), o gateway agora retorna imediatamente um erro 504 em vez de uma série de tentativas silenciosas. Nota importante sobre cobrança: uma solicitação aceita pela rede não pode ser cancelada — o nó processa de qualquer maneira, portanto, em caso de timeout, a estimativa de processamento do prompt é debitada (a completion não é tarifada). Recomendação: para gerações longas, use stream:true — o streaming é mais resistente a timeouts e mostra o progresso imediatamente.

Novo
Escada de taxas para depósitos em USDT — até −50%9 de jul.

A taxa de depósito via USDT agora diminui conforme o valor aumenta: base de 5%, a partir de $25 — 4.5%, a partir de $50 — 4%, a partir de $100 — 3.5%, a partir de $250 — 3%, a partir de $500 — 2.75%, a partir de $1000 — 2.5%. O diálogo de depósito apresenta uma escada interativa: controle deslizante de valor, bônus GNK de cada nível e sua economia. O desconto é aplicado automaticamente após o crédito.

junho de 2026
Novo
Limite total de gastos para a chave28 de jun.

Você pode definir um limite total (cumulativo) de gastos para chaves secundárias — uma cota dedicada que não é redefinida, ao contrário dos limites diários ou mensais. Quando a cota é esgotada, as solicitações usando a chave são rejeitadas. O limite é definido no painel (com precisão de nanogonka) ou via API usando o campo limit_total_ngonka em POST/PATCH /api/management/keys/{id}/children; o consumo acumulado é zerado com o botão "Reset usage" (ou POST /api/management/keys/{id}/children/{childId}/reset-usage).

Melhoria
Preço — pelo custo real da rede27 de jun.

Os custos de inferenced estão sincronizados com o preço real de rede da Gonka por token. Os preços permanecem entre os mais baixos do mercado — frações de um centavo por milhão de tokens, centenas de vezes mais baratos que OpenAI e Anthropic para os mesmos modelos open-source. Tokens de saída são tarifados de forma mais cara que os de entrada (×3), como na maioria dos provedores.

Melhoria
Contexto de até 200.000 tokens27 de jun.

Confirmamos o limite real de contexto dos modelos ativos — até 200.000 tokens (anteriormente, eram publicados números conservadores de 131.072). Você pode enviar documentos e históricos de diálogo mais longos; as especificações atuais de cada modelo podem ser encontradas na seção "Network Status".

Melhoria
Custo das requisições em USD23 de jun.

O custo de cada requisição é exibido em USD — na resposta da API (campo usage.total_cost_usd) e na seção "Uso". Útil para planejar despesas.

Novo
Conexão com um comando23 de jun.

Configure o acesso à API na sua ferramenta automaticamente: execute npx @joingonka/setup. Suporte para Claude Code, OpenClaw, Cline, Continue, opencode, Aider e outros.

Novo
Busca na web em tempo real17 de jun.

O modelo pesquisa na internet durante a resposta e adiciona links para as fontes. Como ativar: passe no corpo da solicitação plugins: [{ "id": "web", "max_results": 5 }] — funciona em APIs compatíveis com OpenAI e Anthropic.

maio de 2026
Melhoria
Respostas longas de até 8192 tokens25 de mai.

A duração máxima da resposta é de até 8192 tokens; gerencie o parâmetro max_tokens (padrão 1024 para streaming e 1500 para resposta normal).

Novo
Seleção de modelo no chat5 de mai.

Na página "Chat", selecione um modelo da lista (carregada via /v1/models) — a seleção é salva e aplicada aos novos diálogos.

Melhoria
Métricas de velocidade de resposta5 de mai.

Precisa de velocidade? Adicione à sua solicitação o cabeçalho x-joingonka-meta: 1 — na resposta por streaming você receberá ttft_ms (tempo até o primeiro token) e tokens_per_sec.

março de 2026
Novo
Chaves de gerenciamento para revenda24 de mar.

Crie uma chave de gerenciamento (POST /api/management/keys) e gere chaves filhas com limites (cota diária e mensal, rate limit, expiração) via POST /api/management/keys/{id}/children.

Novo
Plugins de processamento de solicitações24 de mar.

Conecte plugins via parâmetro plugins: response-healing conserta JSON truncado, privacy-sanitization mascara dados privados, file-parser extrai texto de PDFs e documentos.

Novo
API compatível com OpenAI e Anthropic19 de mar.

OpenAI: base_url https://gate.joingonka.ai/v1, cabeçalho Authorization: Bearer sua-chave. Anthropic (Claude Code): base_url https://gate.joingonka.ai, cabeçalho x-api-key, endpoint /v1/messages.

Novo
Depósitos em GNK e USDT18 de mar.

GNK: obtenha o endereço e o memo, e envie tokens on-chain. USDT: especifique um valor de 1 a 10 000 dólares e pague via OxaPay — a conversão para GNK é automática.