Updates und Status
Aktueller Status der Inferenz und Änderungshistorie des Gateways.
Aktueller Status
- MiniMax M2.7Gonka Network: Betriebsbereit
- Kimi K2.6Gonka Network: Betriebsbereit
- DeepSeek V4 FlashGonka Network: Betriebsbereit
Das Set der aktiven Modelle wird durch Gonka-Netzwerkabstimmungen bestimmt und kann sich ändern: Einige Modelle sind zeitweise nicht verfügbar und kehren später zurück. Die aktuelle Liste finden Sie oben.
Detaillierter Status und Uptime →Update-Historie
Die maximale Länge einer einzelnen Antwort für DeepSeek V4 Flash wurde um das Vierfache erhöht: von 8.192 auf 32.768 Tokens (max_tokens-Parameter). Große Dateien und lange Antworten von Agent-Tools passen nun in einen einzigen Aufruf. Zusätzlich: Wenn die Antwort mitten im Tool-Aufruf das Limit erreicht, gibt das Gateway ein korrektes finish_reason="length" zurück, anstatt einen abgeschnittenen Aufruf — Agent-Clients (Cursor und andere) arbeiten korrekt weiter, anstatt wegen eines Parsing-Fehlers hängenzubleiben.
Ein drittes aktives Modell ist im Gonka-Netzwerk verfügbar — DeepSeek V4 Flash 0731: 380.000 Token Kontext (der längste im Netzwerk, durch eine reale 381K-Anfrage verifiziert), reasoning und tool calling. Die Kennung lautet deepseek-ai/DeepSeek-V4-Flash-0731, die Preise sind identisch mit denen der anderen Modelle. Das Modell befindet sich in der frühen Testphase, ist aber vollständig verfügbar: Wählen Sie es im Dashboard-Chat aus oder geben Sie es im Feld model Ihrer API-Anfrage an.
Ab dem 3. August betragen die Inferenzkosten: Eingang — 22 nGNK, Ausgang — 66 nGNK pro Token (das Doppelte der bisherigen 11/33). Die Gateway-Gebühr bleibt unverändert bei 10%. Der Demo-Modus bleibt kostenlos. Die aktuellen Preise für alle Modelle finden Sie auf der Pricing-Seite und unter GET /api/pricing.
Wenn das Gonka-Netzwerk eine Anfrage erhält, aber nicht antwortet (300s Timeout), gibt das Gateway jetzt sofort einen 504-Fehler zurück, anstatt eine Reihe stummer Wiederholungsversuche durchzuführen. Wichtiger Hinweis zur Abrechnung: Eine vom Netzwerk akzeptierte Anfrage kann nicht storniert werden — der Node verarbeitet sie in jedem Fall, daher wird bei einem Timeout die geschätzte Prompt-Verarbeitung abgezogen (die completion wird nicht berechnet). Empfehlung: Verwenden Sie für lange Generierungen stream:true — Streaming ist resistenter gegen Timeouts und zeigt den Fortschritt sofort an.
Die Gebühr für Einzahlungen via USDT sinkt nun mit zunehmendem Betrag: Basis 5%, ab $25 — 4.5%, ab $50 — 4%, ab $100 — 3.5%, ab $250 — 3%, ab $500 — 2.75%, ab $1000 — 2.5%. Der Einzahlungsdialog enthält eine interaktive Staffelung: Betrag-Schieberegler, GNK-Bonus für jede Stufe und Ihre Ersparnisse. Der Rabatt wird bei der Gutschrift automatisch angewendet.
Sie können ein gesamtes (kumulatives) Ausgabenlimit für untergeordnete Schlüssel festlegen – ein dediziertes Kontingent, das im Gegensatz zu täglichen oder monatlichen Limits nicht zurückgesetzt wird. Sobald das Kontingent aufgebraucht ist, werden Anfragen mit diesem Schlüssel abgelehnt. Das Limit wird im Dashboard (mit nanogonka-Präzision) oder über die API im Feld limit_total_ngonka unter POST/PATCH /api/management/keys/{id}/children eingestellt; der kumulierte Verbrauch wird über die Schaltfläche "Reset usage" (oder POST /api/management/keys/{id}/children/{childId}/reset-usage) zurückgesetzt.
Die Kosten für inferenced sind mit dem tatsächlichen Gonka-Netzwerkpreis pro Token synchronisiert. Die Preise bleiben einige der niedrigsten auf dem Markt – Bruchteile eines Cents pro Million Token, Hunderte Male günstiger als OpenAI und Anthropic bei denselben open-source Modellen. Ausgabesegmente (Output-Token) werden teurer berechnet als Eingabesegmente (Input-Token) (×3), wie bei den meisten Anbietern.
Wir haben das tatsächliche Kontextlimit der aktiven Modelle bestätigt – bis zu 200 000 Token (zuvor wurden niedrigere 131 072 angegeben). Sie können jetzt längere Dokumente und Chat-Verläufe senden; die aktuellen Spezifikationen jedes Modells finden Sie im Bereich «Netzwerkstatus».
Die Kosten jeder Anfrage werden in USD angezeigt – in der API-Antwort (Feld usage.total_cost_usd) und im Bereich „Nutzung“. Praktisch für die Budgetplanung.
Konfigurieren Sie den API-Zugang in Ihrem Tool automatisch: führen Sie npx @joingonka/setup aus. Unterstützt Claude Code, OpenClaw, Cline, Continue, opencode, Aider und weitere.
Das Modell durchsucht das Internet während der Antwortgenerierung und fügt Quellenlinks hinzu. Aktivierung: Übergeben Sie im Anfrage-Body plugins: [{ "id": "web", "max_results": 5 }] – funktioniert in der OpenAI- und Anthropic-kompatiblen API.
Die maximale Antwortlänge beträgt bis zu 8192 Token; steuern Sie dies über den Parameter max_tokens (Standardwert: 1024 für Streaming-Antworten und 1500 für reguläre Antworten).
Wählen Sie auf der „Chat“-Seite ein Modell aus der Liste (wird von /v1/models geladen) – die Auswahl wird gespeichert und auf neue Dialoge angewendet.
Brauchen Sie Geschwindigkeit? Fügen Sie den Header x-joingonka-meta: 1 zur Anfrage hinzu – in der Streaming-Antwort werden ttft_ms (Zeit bis zum ersten Token) und tokens_per_sec übermittelt.
Erstellen Sie einen Management-Schlüssel (POST /api/management/keys) und generieren Sie untergeordnete Schlüssel mit Limits (tägliche/monatliche Quote, Rate Limit, Laufzeit) über POST /api/management/keys/{id}/children.
Binden Sie Plugins mit dem Parameter plugins ein: response-healing repariert abgeschnittenes JSON, privacy-sanitization maskiert private Daten, file-parser extrahiert Text aus PDF und Dokumenten.
OpenAI: base_url https://gate.joingonka.ai/v1, Header Authorization: Bearer Ihr-Schlüssel. Anthropic (Claude Code): base_url https://gate.joingonka.ai, Header x-api-key, endpoint /v1/messages.
GNK: Adresse und Memo abrufen und Token on-chain senden. USDT: Betrag zwischen 1 und 10.000 USD angeben und über OxaPay bezahlen – die Konvertierung in GNK erfolgt automatisch.