Actualizaciones y estado
Estado actual de inferenced e historial de cambios de la pasarela.
Estado actual
- MiniMax M2.7Red Gonka: Operativa
- Kimi K2.6Red Gonka: Operativa
- DeepSeek V4 FlashRed Gonka: Operativa
El conjunto de modelos activos se define mediante la votación de la red Gonka y puede cambiar: algunos modelos pueden no estar disponibles temporalmente y volver más tarde. La lista actual se encuentra arriba.
Estado detallado y uptime →Historial de actualizaciones
La longitud máxima de una respuesta única para DeepSeek V4 Flash se ha incrementado 4 veces: de 8,192 a 32,768 tokens (parámetro max_tokens). Los archivos grandes y las respuestas largas de herramientas de agentes ahora caben en una sola llamada. Además: si la respuesta alcanza el límite en medio de una llamada de herramienta, la puerta de enlace devuelve un finish_reason="length" adecuado en lugar de una llamada truncada; los clientes de agentes (Cursor y otros) continúan funcionando correctamente en lugar de colgarse por un error de análisis.
Ha aparecido un tercer modelo activo en la red Gonka: DeepSeek V4 Flash 0731: contexto de 380,000 tokens (el más largo de la red, verificado mediante una solicitud real de 381K), reasoning y tool calling. El identificador es deepseek-ai/DeepSeek-V4-Flash-0731, el precio es el mismo que el de los otros modelos. El modelo está en fase de prueba temprana pero totalmente disponible: selecciónelo en el chat del panel o especifíquelo en el campo model de su solicitud de API.
A partir del 3 de agosto, el costo de inferencia es: entrada — 22 nGNK, salida — 66 nGNK por token (el doble de los 11/33 anteriores). La comisión de la pasarela se mantiene sin cambios en 10%. El modo demo sigue siendo gratuito. Los precios actuales de todos los modelos están en la página Pricing y en GET /api/pricing.
Si la red Gonka recibe una solicitud pero no responde (timeout de 300s), ahora el gateway devuelve inmediatamente un error 504 en lugar de una serie de reintentos silenciosos. Nota importante sobre el cobro: una solicitud aceptada por la red no se puede cancelar; el nodo la procesa de todos modos, por lo que en caso de timeout se descuenta la estimación de procesamiento del prompt (la finalización no se factura). Recomendación: para generaciones largas, utilice stream:true; el streaming es más resistente a los timeouts y muestra el progreso de inmediato.
La comisión por depósitos en USDT ahora disminuye según el monto: base del 5%, desde $25 — 4.5%, desde $50 — 4%, desde $100 — 3.5%, desde $250 — 3%, desde $500 — 2.75%, desde $1000 — 2.5%. El cuadro de diálogo de depósito incluye una escala interactiva: deslizador de monto, bono GNK de cada nivel y sus ahorros. El descuento se aplica automáticamente al recibir el depósito.
Se puede establecer un límite de gasto total (acumulativo) para las claves secundarias: una cuota dedicada que no se reinicia, a diferencia de los límites diarios o mensuales. Cuando se agota la cuota, las solicitudes que utilizan la clave son rechazadas. El límite se establece en el panel de control (con precisión de nanogonka) o mediante la API utilizando el campo limit_total_ngonka en POST/PATCH /api/management/keys/{id}/children; el consumo acumulado se restablece con el botón "Reset usage" (o POST /api/management/keys/{id}/children/{childId}/reset-usage).
Los costos de inferenced están sincronizados con el precio de red real de Gonka por token. Los precios siguen siendo de los más bajos del mercado — fracciones de un centavo por millón de tokens, cientos de veces más baratos que OpenAI y Anthropic con los mismos modelos open-source. Los tokens de salida tienen un precio más alto que los de entrada (×3), como en la mayoría de los proveedores.
Hemos confirmado el límite real de contexto de los modelos activos: hasta 200,000 tokens (antes se publicaban 131,072 como cifra conservadora). Ahora puede enviar documentos e historiales de diálogo más largos; las características actuales de cada modelo se encuentran en la sección "Network Status".
El costo de cada solicitud se muestra en USD — en la respuesta de la API (campo usage.total_cost_usd) y en la sección "Uso". Es útil para planificar gastos.
Configure el acceso a la API en su herramienta automáticamente: ejecute npx @joingonka/setup. Compatible con Claude Code, OpenClaw, Cline, Continue, opencode, Aider y otros.
El modelo busca en internet durante la respuesta y añade enlaces a las fuentes. Cómo activarlo: pase en el cuerpo de la solicitud plugins: [{ "id": "web", "max_results": 5 }] — funciona en APIs compatibles con OpenAI y Anthropic.
La longitud máxima de respuesta es de hasta 8192 tokens; gestione el parámetro max_tokens (por defecto 1024 para respuestas en streaming y 1500 para las normales).
En la página "Chat", seleccione un modelo de la lista (cargado desde /v1/models) — la selección se guarda y se aplica a los nuevos diálogos.
¿Necesita velocidad? Añada a su solicitud la cabecera x-joingonka-meta: 1 — en la respuesta en streaming recibirá ttft_ms (tiempo hasta el primer token) y tokens_per_sec.
Cree una clave de gestión (POST /api/management/keys) y genere claves secundarias con límites (cuota diaria y mensual, rate limit, expiración) mediante POST /api/management/keys/{id}/children.
Conecte plugins mediante el parámetro plugins: response-healing repara JSON truncado, privacy-sanitization oculta datos privados, file-parser extrae texto de PDFs y documentos.
OpenAI: base_url https://gate.joingonka.ai/v1, cabecera Authorization: Bearer su-clave. Anthropic (Claude Code): base_url https://gate.joingonka.ai, cabecera x-api-key, endpoint /v1/messages.
GNK: obtenga la dirección y el memo, y envíe los tokens on-chain. USDT: especifique un monto de 1 a 10 000 dólares y pague a través de OxaPay — la conversión a GNK es automática.