Updates und Status

Aktueller Status der Inferenz und Änderungshistorie des Gateways.

Aktueller Status

Gonka Network: Betriebsbereit
Netzwerkmodelle
  • MiniMax M2.7Gonka Network: Betriebsbereit
  • Kimi K2.6Gonka Network: Betriebsbereit
  • DeepSeek V4 FlashGonka Network: Betriebsbereit

Das Set der aktiven Modelle wird durch Gonka-Netzwerkabstimmungen bestimmt und kann sich ändern: Einige Modelle sind zeitweise nicht verfügbar und kehren später zurück. Die aktuelle Liste finden Sie oben.

Detaillierter Status und Uptime →

Update-Historie

August 2026
Verbesserung
DeepSeek Antwortlimit — 32.768 Tokens17. Aug.

Die maximale Länge einer einzelnen Antwort für DeepSeek V4 Flash wurde um das Vierfache erhöht: von 8.192 auf 32.768 Tokens (max_tokens-Parameter). Große Dateien und lange Antworten von Agent-Tools passen nun in einen einzigen Aufruf. Zusätzlich: Wenn die Antwort mitten im Tool-Aufruf das Limit erreicht, gibt das Gateway ein korrektes finish_reason="length" zurück, anstatt einen abgeschnittenen Aufruf — Agent-Clients (Cursor und andere) arbeiten korrekt weiter, anstatt wegen eines Parsing-Fehlers hängenzubleiben.

Neu
Neues Modell: DeepSeek V4 Flash mit 380K Kontext13. Aug.

Ein drittes aktives Modell ist im Gonka-Netzwerk verfügbar — DeepSeek V4 Flash 0731: 380.000 Token Kontext (der längste im Netzwerk, durch eine reale 381K-Anfrage verifiziert), reasoning und tool calling. Die Kennung lautet deepseek-ai/DeepSeek-V4-Flash-0731, die Preise sind identisch mit denen der anderen Modelle. Das Modell befindet sich in der frühen Testphase, ist aber vollständig verfügbar: Wählen Sie es im Dashboard-Chat aus oder geben Sie es im Feld model Ihrer API-Anfrage an.

Verbesserung
Aktualisierung der Inferenzpreise3. Aug.

Ab dem 3. August betragen die Inferenzkosten: Eingang — 22 nGNK, Ausgang — 66 nGNK pro Token (das Doppelte der bisherigen 11/33). Die Gateway-Gebühr bleibt unverändert bei 10%. Der Demo-Modus bleibt kostenlos. Die aktuellen Preise für alle Modelle finden Sie auf der Pricing-Seite und unter GET /api/pricing.

Juli 2026
Verbesserung
Faire Timeouts: schnelle 504 statt 5 Minuten Wartezeit23. Juli

Wenn das Gonka-Netzwerk eine Anfrage erhält, aber nicht antwortet (300s Timeout), gibt das Gateway jetzt sofort einen 504-Fehler zurück, anstatt eine Reihe stummer Wiederholungsversuche durchzuführen. Wichtiger Hinweis zur Abrechnung: Eine vom Netzwerk akzeptierte Anfrage kann nicht storniert werden — der Node verarbeitet sie in jedem Fall, daher wird bei einem Timeout die geschätzte Prompt-Verarbeitung abgezogen (die completion wird nicht berechnet). Empfehlung: Verwenden Sie für lange Generierungen stream:true — Streaming ist resistenter gegen Timeouts und zeigt den Fortschritt sofort an.

Neu
USDT-Einzahlungsgebühren-Staffelung — bis zu −50%9. Juli

Die Gebühr für Einzahlungen via USDT sinkt nun mit zunehmendem Betrag: Basis 5%, ab $25 — 4.5%, ab $50 — 4%, ab $100 — 3.5%, ab $250 — 3%, ab $500 — 2.75%, ab $1000 — 2.5%. Der Einzahlungsdialog enthält eine interaktive Staffelung: Betrag-Schieberegler, GNK-Bonus für jede Stufe und Ihre Ersparnisse. Der Rabatt wird bei der Gutschrift automatisch angewendet.

Juni 2026
Neu
Gesamtausgabenlimit für den Schlüssel28. Juni

Sie können ein gesamtes (kumulatives) Ausgabenlimit für untergeordnete Schlüssel festlegen – ein dediziertes Kontingent, das im Gegensatz zu täglichen oder monatlichen Limits nicht zurückgesetzt wird. Sobald das Kontingent aufgebraucht ist, werden Anfragen mit diesem Schlüssel abgelehnt. Das Limit wird im Dashboard (mit nanogonka-Präzision) oder über die API im Feld limit_total_ngonka unter POST/PATCH /api/management/keys/{id}/children eingestellt; der kumulierte Verbrauch wird über die Schaltfläche "Reset usage" (oder POST /api/management/keys/{id}/children/{childId}/reset-usage) zurückgesetzt.

Verbesserung
Preisgestaltung – zum tatsächlichen Netzwerkpreis27. Juni

Die Kosten für inferenced sind mit dem tatsächlichen Gonka-Netzwerkpreis pro Token synchronisiert. Die Preise bleiben einige der niedrigsten auf dem Markt – Bruchteile eines Cents pro Million Token, Hunderte Male günstiger als OpenAI und Anthropic bei denselben open-source Modellen. Ausgabesegmente (Output-Token) werden teurer berechnet als Eingabesegmente (Input-Token) (×3), wie bei den meisten Anbietern.

Verbesserung
Kontext bis zu 200 000 Token27. Juni

Wir haben das tatsächliche Kontextlimit der aktiven Modelle bestätigt – bis zu 200 000 Token (zuvor wurden niedrigere 131 072 angegeben). Sie können jetzt längere Dokumente und Chat-Verläufe senden; die aktuellen Spezifikationen jedes Modells finden Sie im Bereich «Netzwerkstatus».

Verbesserung
Kosten für Anfragen in USD23. Juni

Die Kosten jeder Anfrage werden in USD angezeigt – in der API-Antwort (Feld usage.total_cost_usd) und im Bereich „Nutzung“. Praktisch für die Budgetplanung.

Neu
Installation mit einem Befehl23. Juni

Konfigurieren Sie den API-Zugang in Ihrem Tool automatisch: führen Sie npx @joingonka/setup aus. Unterstützt Claude Code, OpenClaw, Cline, Continue, opencode, Aider und weitere.

Neu
Echtzeit-Websuche17. Juni

Das Modell durchsucht das Internet während der Antwortgenerierung und fügt Quellenlinks hinzu. Aktivierung: Übergeben Sie im Anfrage-Body plugins: [{ "id": "web", "max_results": 5 }] – funktioniert in der OpenAI- und Anthropic-kompatiblen API.

Mai 2026
Verbesserung
Lange Antworten bis zu 8192 Token25. Mai

Die maximale Antwortlänge beträgt bis zu 8192 Token; steuern Sie dies über den Parameter max_tokens (Standardwert: 1024 für Streaming-Antworten und 1500 für reguläre Antworten).

Neu
Modellauswahl im Chat5. Mai

Wählen Sie auf der „Chat“-Seite ein Modell aus der Liste (wird von /v1/models geladen) – die Auswahl wird gespeichert und auf neue Dialoge angewendet.

Verbesserung
Antwortgeschwindigkeits-Metriken5. Mai

Brauchen Sie Geschwindigkeit? Fügen Sie den Header x-joingonka-meta: 1 zur Anfrage hinzu – in der Streaming-Antwort werden ttft_ms (Zeit bis zum ersten Token) und tokens_per_sec übermittelt.

März 2026
Neu
Management-Schlüssel für Reselling24. März

Erstellen Sie einen Management-Schlüssel (POST /api/management/keys) und generieren Sie untergeordnete Schlüssel mit Limits (tägliche/monatliche Quote, Rate Limit, Laufzeit) über POST /api/management/keys/{id}/children.

Neu
Plugins zur Anfrageverarbeitung24. März

Binden Sie Plugins mit dem Parameter plugins ein: response-healing repariert abgeschnittenes JSON, privacy-sanitization maskiert private Daten, file-parser extrahiert Text aus PDF und Dokumenten.

Neu
OpenAI- und Anthropic-kompatible API19. März

OpenAI: base_url https://gate.joingonka.ai/v1, Header Authorization: Bearer Ihr-Schlüssel. Anthropic (Claude Code): base_url https://gate.joingonka.ai, Header x-api-key, endpoint /v1/messages.

Neu
Einzahlungen in GNK und USDT18. März

GNK: Adresse und Memo abrufen und Token on-chain senden. USDT: Betrag zwischen 1 und 10.000 USD angeben und über OxaPay bezahlen – die Konvertierung in GNK erfolgt automatisch.