Actualizaciones y estado

Estado actual de inferenced e historial de cambios de la pasarela.

Estado actual

Red Gonka: Operativa
Modelos de red
  • MiniMax M2.7Red Gonka: Operativa
  • Kimi K2.6Red Gonka: Operativa
  • DeepSeek V4 FlashRed Gonka: Operativa

El conjunto de modelos activos se define mediante la votación de la red Gonka y puede cambiar: algunos modelos pueden no estar disponibles temporalmente y volver más tarde. La lista actual se encuentra arriba.

Estado detallado y uptime →

Historial de actualizaciones

agosto de 2026
Mejora
Límite de respuesta de DeepSeek — 32,768 tokens17 ago

La longitud máxima de una respuesta única para DeepSeek V4 Flash se ha incrementado 4 veces: de 8,192 a 32,768 tokens (parámetro max_tokens). Los archivos grandes y las respuestas largas de herramientas de agentes ahora caben en una sola llamada. Además: si la respuesta alcanza el límite en medio de una llamada de herramienta, la puerta de enlace devuelve un finish_reason="length" adecuado en lugar de una llamada truncada; los clientes de agentes (Cursor y otros) continúan funcionando correctamente en lugar de colgarse por un error de análisis.

Nuevo
Nuevo modelo: DeepSeek V4 Flash con contexto de 380K13 ago

Ha aparecido un tercer modelo activo en la red Gonka: DeepSeek V4 Flash 0731: contexto de 380,000 tokens (el más largo de la red, verificado mediante una solicitud real de 381K), reasoning y tool calling. El identificador es deepseek-ai/DeepSeek-V4-Flash-0731, el precio es el mismo que el de los otros modelos. El modelo está en fase de prueba temprana pero totalmente disponible: selecciónelo en el chat del panel o especifíquelo en el campo model de su solicitud de API.

Mejora
Actualización de precios de inferencia3 ago

A partir del 3 de agosto, el costo de inferencia es: entrada — 22 nGNK, salida — 66 nGNK por token (el doble de los 11/33 anteriores). La comisión de la pasarela se mantiene sin cambios en 10%. El modo demo sigue siendo gratuito. Los precios actuales de todos los modelos están en la página Pricing y en GET /api/pricing.

julio de 2026
Mejora
Timeouts justos: 504 rápido en lugar de 5 minutos de espera23 jul

Si la red Gonka recibe una solicitud pero no responde (timeout de 300s), ahora el gateway devuelve inmediatamente un error 504 en lugar de una serie de reintentos silenciosos. Nota importante sobre el cobro: una solicitud aceptada por la red no se puede cancelar; el nodo la procesa de todos modos, por lo que en caso de timeout se descuenta la estimación de procesamiento del prompt (la finalización no se factura). Recomendación: para generaciones largas, utilice stream:true; el streaming es más resistente a los timeouts y muestra el progreso de inmediato.

Nuevo
Escala de comisiones para depósitos en USDT — hasta −50%9 jul

La comisión por depósitos en USDT ahora disminuye según el monto: base del 5%, desde $25 — 4.5%, desde $50 — 4%, desde $100 — 3.5%, desde $250 — 3%, desde $500 — 2.75%, desde $1000 — 2.5%. El cuadro de diálogo de depósito incluye una escala interactiva: deslizador de monto, bono GNK de cada nivel y sus ahorros. El descuento se aplica automáticamente al recibir el depósito.

junio de 2026
Nuevo
Límite de gasto total para la clave28 jun

Se puede establecer un límite de gasto total (acumulativo) para las claves secundarias: una cuota dedicada que no se reinicia, a diferencia de los límites diarios o mensuales. Cuando se agota la cuota, las solicitudes que utilizan la clave son rechazadas. El límite se establece en el panel de control (con precisión de nanogonka) o mediante la API utilizando el campo limit_total_ngonka en POST/PATCH /api/management/keys/{id}/children; el consumo acumulado se restablece con el botón "Reset usage" (o POST /api/management/keys/{id}/children/{childId}/reset-usage).

Mejora
Precio — al costo real de la red27 jun

Los costos de inferenced están sincronizados con el precio de red real de Gonka por token. Los precios siguen siendo de los más bajos del mercado — fracciones de un centavo por millón de tokens, cientos de veces más baratos que OpenAI y Anthropic con los mismos modelos open-source. Los tokens de salida tienen un precio más alto que los de entrada (×3), como en la mayoría de los proveedores.

Mejora
Contexto de hasta 200,000 tokens27 jun

Hemos confirmado el límite real de contexto de los modelos activos: hasta 200,000 tokens (antes se publicaban 131,072 como cifra conservadora). Ahora puede enviar documentos e historiales de diálogo más largos; las características actuales de cada modelo se encuentran en la sección "Network Status".

Mejora
Costo de las solicitudes en USD23 jun

El costo de cada solicitud se muestra en USD — en la respuesta de la API (campo usage.total_cost_usd) y en la sección "Uso". Es útil para planificar gastos.

Nuevo
Conexión con un comando23 jun

Configure el acceso a la API en su herramienta automáticamente: ejecute npx @joingonka/setup. Compatible con Claude Code, OpenClaw, Cline, Continue, opencode, Aider y otros.

Nuevo
Búsqueda web en tiempo real17 jun

El modelo busca en internet durante la respuesta y añade enlaces a las fuentes. Cómo activarlo: pase en el cuerpo de la solicitud plugins: [{ "id": "web", "max_results": 5 }] — funciona en APIs compatibles con OpenAI y Anthropic.

mayo de 2026
Mejora
Respuestas largas de hasta 8192 tokens25 may

La longitud máxima de respuesta es de hasta 8192 tokens; gestione el parámetro max_tokens (por defecto 1024 para respuestas en streaming y 1500 para las normales).

Nuevo
Selección de modelo en el chat5 may

En la página "Chat", seleccione un modelo de la lista (cargado desde /v1/models) — la selección se guarda y se aplica a los nuevos diálogos.

Mejora
Métricas de velocidad de respuesta5 may

¿Necesita velocidad? Añada a su solicitud la cabecera x-joingonka-meta: 1 — en la respuesta en streaming recibirá ttft_ms (tiempo hasta el primer token) y tokens_per_sec.

marzo de 2026
Nuevo
Claves de gestión para reventa24 mar

Cree una clave de gestión (POST /api/management/keys) y genere claves secundarias con límites (cuota diaria y mensual, rate limit, expiración) mediante POST /api/management/keys/{id}/children.

Nuevo
Plugins de procesamiento de solicitudes24 mar

Conecte plugins mediante el parámetro plugins: response-healing repara JSON truncado, privacy-sanitization oculta datos privados, file-parser extrae texto de PDFs y documentos.

Nuevo
API compatible con OpenAI y Anthropic19 mar

OpenAI: base_url https://gate.joingonka.ai/v1, cabecera Authorization: Bearer su-clave. Anthropic (Claude Code): base_url https://gate.joingonka.ai, cabecera x-api-key, endpoint /v1/messages.

Nuevo
Depósitos en GNK y USDT18 mar

GNK: obtenga la dirección y el memo, y envíe los tokens on-chain. USDT: especifique un monto de 1 a 10 000 dólares y pague a través de OxaPay — la conversión a GNK es automática.