अपडेट्स और स्टेटस

इन्फरेन्स की वर्तमान स्थिति और गेटवे का चेंजलॉग।

वर्तमान स्थिति

गोंका नेटवर्क: चालू
नेटवर्क मॉडल
  • MiniMax M2.7गोंका नेटवर्क: चालू
  • Kimi K2.6गोंका नेटवर्क: चालू
  • DeepSeek V4 Flashगोंका नेटवर्क: चालू

सक्रिय मॉडलों का चयन Gonka नेटवर्क द्वारा वोटिंग के माध्यम से किया जाता है और यह बदल सकता है: कुछ मॉडल कभी-कभी उपलब्ध नहीं होते और बाद में वापस आ जाते हैं। अद्यतन सूची ऊपर दी गई है।

विस्तृत स्टेटस और अपटाइम →

अपडेट्स का इतिहास

अगस्त 2026
सुधार
DeepSeek रिस्पॉन्स लिमिट — 32,768 टोकन17 अग॰

DeepSeek V4 Flash के लिए एक सिंगल रिस्पॉन्स की अधिकतम लंबाई 4 गुना बढ़ा दी गई है: 8,192 से 32,768 टोकन (max_tokens पैरामीटर) तक। बड़ी फाइलें और एजेंट टूल के लंबे रिस्पॉन्स अब एक ही कॉल में समा जाते हैं। इसके अतिरिक्त: यदि रिस्पॉन्स टूल कॉल के बीच में ही लिमिट तक पहुँच जाता है, तो गेटवे टूटी हुई कॉल के बजाय एक सही finish_reason="length" लौटाता है — एजेंट क्लाइंट्स (Cursor और अन्य) पार्सिंग त्रुटि पर लटकने के बजाय सही ढंग से काम करना जारी रखते हैं।

नया
नया मॉडल: 380K संदर्भ (context) के साथ DeepSeek V4 Flash13 अग॰

Gonka नेटवर्क में तीसरा सक्रिय मॉडल आ गया है — DeepSeek V4 Flash 0731: 380,000 टोकन संदर्भ (नेटवर्क में सबसे लंबा, 381K के वास्तविक अनुरोध द्वारा सत्यापित), reasoning और tool calling। इसका आइडेंटिफायर deepseek-ai/DeepSeek-V4-Flash-0731 है, और कीमत अन्य मॉडलों के समान है। मॉडल शुरुआती परीक्षण में है, लेकिन पूरी तरह से उपलब्ध है: डैशबोर्ड चैट में इसे चुनें या अपने API अनुरोध के model फ़ील्ड में इसे निर्दिष्ट करें।

सुधार
इन्फरेन्स मूल्य निर्धारण अपडेट3 अग॰

3 अगस्त से, इन्फरेन्स की लागत: इनपुट — 22 nGNK, आउटपुट — 66 nGNK प्रति टोकन (पिछले 11/33 से दोगुना) है। गेटवे शुल्क 10% पर अपरिवर्तित है। डेमो मोड मुफ़्त है। सभी मॉडलों की वर्तमान कीमतें Pricing पेज और GET /api/pricing पर उपलब्ध हैं।

जुलाई 2026
सुधार
निष्पक्ष टाइमआउट: 5 मिनट के हैंग के बजाय तेज़ 50423 जुल॰

यदि Gonka नेटवर्क को कोई अनुरोध मिलता है लेकिन वह प्रतिक्रिया नहीं देता है (300s टाइमआउट), तो गेटवे अब मौन पुन: प्रयास की श्रृंखला के बजाय तुरंत 504 त्रुटि लौटाता है। बिलिंग पर महत्वपूर्ण नोट: नेटवर्क द्वारा स्वीकार किए गए अनुरोध को रद्द नहीं किया जा सकता है — नोड इसे हर हाल में संसाधित करता है, इसलिए टाइमआउट के मामले में प्रॉम्प्ट प्रोसेसिंग का अनुमान काट लिया जाता है (completion के लिए शुल्क नहीं लिया जाता है)। अनुशंसा: लंबे जनरेशन के लिए, stream:true का उपयोग करें — स्ट्रीम टाइमआउट के प्रति अधिक प्रतिरोधी है और तुरंत प्रगति दिखाती है।

नया
USDT डिपॉजिट शुल्क में कमी (स्लैब आधारित) — -50% तक9 जुल॰

USDT के माध्यम से डिपॉजिट शुल्क अब राशि बढ़ने पर कम हो जाता है: आधार 5%, $25 से — 4.5%, $50 से — 4%, $100 से — 3.5%, $250 से — 3%, $500 से — 2.75%, $1000 से — 2.5%। डिपॉजिट डायलॉग में एक इंटरैक्टिव लैडर है: राशि स्लाइडर, प्रत्येक स्तर पर GNK बोनस और आपकी बचत। डिपॉजिट क्रेडिट होने पर छूट स्वतः लागू हो जाती है।

जून 2026
नया
कुंजी के लिए कुल व्यय सीमा28 जून

आप चाइल्ड कुंजियों के लिए कुल (संचयी) व्यय सीमा निर्धारित कर सकते हैं — एक समर्पित कोटा जो दैनिक या मासिक सीमाओं के विपरीत रीसेट नहीं होता है। कोटा समाप्त होने पर, कुंजी का उपयोग करने वाले अनुरोधों को अस्वीकार कर दिया जाता है। सीमा डैशबोर्ड में (nanogonka की सटीकता के साथ) या API के माध्यम से POST/PATCH /api/management/keys/{id}/children में limit_total_ngonka फ़ील्ड का उपयोग करके सेट की जाती है; संचयी उपयोग को "Reset usage" बटन (या POST /api/management/keys/{id}/children/{childId}/reset-usage) से रीसेट किया जाता है।

सुधार
मूल्य निर्धारण — वास्तविक नेटवर्क मूल्य पर27 जून

inferenced पर आने वाली लागत को प्रति टोकन वास्तविक Gonka नेटवर्क मूल्य के साथ सिंक किया गया है। कीमतें बाजार में सबसे कम बनी हुई हैं – प्रति मिलियन टोकन पर कुछ सेंट, जो समान open-source मॉडल के लिए OpenAI और Anthropic की तुलना में सैकड़ों गुना सस्ता है। अधिकांश प्रदाताओं की तरह, आउटपुट टोकन (output tokens) इनपुट टोकन (input tokens) की तुलना में अधिक महंगे (×3) हैं।

सुधार
200 000 टोकन तक का कॉन्टेक्स्ट (context)27 जून

हमने सक्रिय मॉडल की वास्तविक कॉन्टेक्स्ट सीमा की पुष्टि की है – 200 000 टोकन तक (पहले कम करके 131 072 बताया गया था)। अब आप लंबे दस्तावेज़ और चैट इतिहास भेज सकते हैं; प्रत्येक मॉडल की वर्तमान विशेषताएं «नेटवर्क स्थिति» अनुभाग में उपलब्ध हैं।

सुधार
USD में अनुरोध लागत23 जून

प्रत्येक अनुरोध की लागत USD में दिखाई देती है — API रिस्पॉन्स (usage.total_cost_usd फ़ील्ड) और "उपयोग" अनुभाग में। खर्चों की योजना बनाना सुविधाजनक है।

नया
एक कमांड से कनेक्टिविटी23 जून

अपने टूल में API एक्सेस को तुरंत सेटअप करें: npx @joingonka/setup चलाएँ। Claude Code, OpenClaw, Cline, Continue, opencode, Aider और अन्य के लिए सपोर्ट।

नया
रियल-टाइम वेब सर्च17 जून

मॉडल रिस्पॉन्स के दौरान इंटरनेट पर सर्च करता है और सोर्स के लिंक जोड़ता है। कैसे सक्षम करें: रिक्वेस्ट बॉडी में plugins: [{ "id": "web", "max_results": 5 }] पास करें — यह OpenAI और Anthropic-संगत API में काम करता है।

मई 2026
सुधार
8192 टोकन तक लंबे रिस्पॉन्स25 मई

अधिकतम रिस्पॉन्स लंबाई 8192 टोकन तक है; max_tokens पैरामीटर को नियंत्रित करें (डिफॉल्ट रूप से स्ट्रीमिंग के लिए 1024 और सामान्य के लिए 1500)।

नया
चैट में मॉडल चयन5 मई

चैट पेज पर सूची से एक मॉडल चुनें (जो /v1/models से लोड होता है) — चयन सहेजा जाता है और नई बातचीत पर लागू होता है।

सुधार
रिस्पॉन्स स्पीड मेट्रिक्स5 मई

क्या गति चाहिए? अनुरोध में x-joingonka-meta: 1 हेडर जोड़ें — स्ट्रीमिंग रिस्पॉन्स में आपको ttft_ms (पहले टोकन तक का समय) और tokens_per_sec मिलेंगे।

मार्च 2026
नया
पुनर्विक्रय के लिए मैनेजमेंट कीज़24 मार्च

एक मैनेजमेंट की (POST /api/management/keys) बनाएँ और POST /api/management/keys/{id}/children के माध्यम से सीमा के साथ (दैनिक और मासिक कोटा, रेट लिमिट, अवधि) चाइल्ड कीज़ जनरेट करें।

नया
रिक्वेस्ट प्रोसेसिंग प्लगइन्स24 मार्च

किसी प्लगइन को plugins पैरामीटर के साथ कनेक्ट करें: response-healing कटे हुए JSON को ठीक करता है, privacy-sanitization निजी डेटा को मास्क करता है, file-parser PDF और दस्तावेजों से टेक्स्ट निकालता है।

नया
OpenAI और Anthropic-संगत API19 मार्च

OpenAI: base_url https://gate.joingonka.ai/v1, हेडर Authorization: Bearer आपकी-की। Anthropic (Claude Code): base_url https://gate.joingonka.ai, हेडर x-api-key, endpoint /v1/messages.

नया
GNK और USDT में डिपॉजिट18 मार्च

GNK: एड्रेस और memo प्राप्त करें और ऑन-चेन टोकन भेजें। USDT: 1 से 10,000 डॉलर तक की राशि निर्दिष्ट करें और OxaPay के माध्यम से भुगतान करें — GNK में रूपांतरण स्वचालित है।