अपडेट्स और स्टेटस
इन्फरेन्स की वर्तमान स्थिति और गेटवे का चेंजलॉग।
वर्तमान स्थिति
- MiniMax M2.7गोंका नेटवर्क: चालू
- Kimi K2.6गोंका नेटवर्क: चालू
- DeepSeek V4 Flashगोंका नेटवर्क: चालू
सक्रिय मॉडलों का चयन Gonka नेटवर्क द्वारा वोटिंग के माध्यम से किया जाता है और यह बदल सकता है: कुछ मॉडल कभी-कभी उपलब्ध नहीं होते और बाद में वापस आ जाते हैं। अद्यतन सूची ऊपर दी गई है।
विस्तृत स्टेटस और अपटाइम →अपडेट्स का इतिहास
DeepSeek V4 Flash के लिए एक सिंगल रिस्पॉन्स की अधिकतम लंबाई 4 गुना बढ़ा दी गई है: 8,192 से 32,768 टोकन (max_tokens पैरामीटर) तक। बड़ी फाइलें और एजेंट टूल के लंबे रिस्पॉन्स अब एक ही कॉल में समा जाते हैं। इसके अतिरिक्त: यदि रिस्पॉन्स टूल कॉल के बीच में ही लिमिट तक पहुँच जाता है, तो गेटवे टूटी हुई कॉल के बजाय एक सही finish_reason="length" लौटाता है — एजेंट क्लाइंट्स (Cursor और अन्य) पार्सिंग त्रुटि पर लटकने के बजाय सही ढंग से काम करना जारी रखते हैं।
Gonka नेटवर्क में तीसरा सक्रिय मॉडल आ गया है — DeepSeek V4 Flash 0731: 380,000 टोकन संदर्भ (नेटवर्क में सबसे लंबा, 381K के वास्तविक अनुरोध द्वारा सत्यापित), reasoning और tool calling। इसका आइडेंटिफायर deepseek-ai/DeepSeek-V4-Flash-0731 है, और कीमत अन्य मॉडलों के समान है। मॉडल शुरुआती परीक्षण में है, लेकिन पूरी तरह से उपलब्ध है: डैशबोर्ड चैट में इसे चुनें या अपने API अनुरोध के model फ़ील्ड में इसे निर्दिष्ट करें।
3 अगस्त से, इन्फरेन्स की लागत: इनपुट — 22 nGNK, आउटपुट — 66 nGNK प्रति टोकन (पिछले 11/33 से दोगुना) है। गेटवे शुल्क 10% पर अपरिवर्तित है। डेमो मोड मुफ़्त है। सभी मॉडलों की वर्तमान कीमतें Pricing पेज और GET /api/pricing पर उपलब्ध हैं।
यदि Gonka नेटवर्क को कोई अनुरोध मिलता है लेकिन वह प्रतिक्रिया नहीं देता है (300s टाइमआउट), तो गेटवे अब मौन पुन: प्रयास की श्रृंखला के बजाय तुरंत 504 त्रुटि लौटाता है। बिलिंग पर महत्वपूर्ण नोट: नेटवर्क द्वारा स्वीकार किए गए अनुरोध को रद्द नहीं किया जा सकता है — नोड इसे हर हाल में संसाधित करता है, इसलिए टाइमआउट के मामले में प्रॉम्प्ट प्रोसेसिंग का अनुमान काट लिया जाता है (completion के लिए शुल्क नहीं लिया जाता है)। अनुशंसा: लंबे जनरेशन के लिए, stream:true का उपयोग करें — स्ट्रीम टाइमआउट के प्रति अधिक प्रतिरोधी है और तुरंत प्रगति दिखाती है।
USDT के माध्यम से डिपॉजिट शुल्क अब राशि बढ़ने पर कम हो जाता है: आधार 5%, $25 से — 4.5%, $50 से — 4%, $100 से — 3.5%, $250 से — 3%, $500 से — 2.75%, $1000 से — 2.5%। डिपॉजिट डायलॉग में एक इंटरैक्टिव लैडर है: राशि स्लाइडर, प्रत्येक स्तर पर GNK बोनस और आपकी बचत। डिपॉजिट क्रेडिट होने पर छूट स्वतः लागू हो जाती है।
आप चाइल्ड कुंजियों के लिए कुल (संचयी) व्यय सीमा निर्धारित कर सकते हैं — एक समर्पित कोटा जो दैनिक या मासिक सीमाओं के विपरीत रीसेट नहीं होता है। कोटा समाप्त होने पर, कुंजी का उपयोग करने वाले अनुरोधों को अस्वीकार कर दिया जाता है। सीमा डैशबोर्ड में (nanogonka की सटीकता के साथ) या API के माध्यम से POST/PATCH /api/management/keys/{id}/children में limit_total_ngonka फ़ील्ड का उपयोग करके सेट की जाती है; संचयी उपयोग को "Reset usage" बटन (या POST /api/management/keys/{id}/children/{childId}/reset-usage) से रीसेट किया जाता है।
inferenced पर आने वाली लागत को प्रति टोकन वास्तविक Gonka नेटवर्क मूल्य के साथ सिंक किया गया है। कीमतें बाजार में सबसे कम बनी हुई हैं – प्रति मिलियन टोकन पर कुछ सेंट, जो समान open-source मॉडल के लिए OpenAI और Anthropic की तुलना में सैकड़ों गुना सस्ता है। अधिकांश प्रदाताओं की तरह, आउटपुट टोकन (output tokens) इनपुट टोकन (input tokens) की तुलना में अधिक महंगे (×3) हैं।
हमने सक्रिय मॉडल की वास्तविक कॉन्टेक्स्ट सीमा की पुष्टि की है – 200 000 टोकन तक (पहले कम करके 131 072 बताया गया था)। अब आप लंबे दस्तावेज़ और चैट इतिहास भेज सकते हैं; प्रत्येक मॉडल की वर्तमान विशेषताएं «नेटवर्क स्थिति» अनुभाग में उपलब्ध हैं।
प्रत्येक अनुरोध की लागत USD में दिखाई देती है — API रिस्पॉन्स (usage.total_cost_usd फ़ील्ड) और "उपयोग" अनुभाग में। खर्चों की योजना बनाना सुविधाजनक है।
अपने टूल में API एक्सेस को तुरंत सेटअप करें: npx @joingonka/setup चलाएँ। Claude Code, OpenClaw, Cline, Continue, opencode, Aider और अन्य के लिए सपोर्ट।
मॉडल रिस्पॉन्स के दौरान इंटरनेट पर सर्च करता है और सोर्स के लिंक जोड़ता है। कैसे सक्षम करें: रिक्वेस्ट बॉडी में plugins: [{ "id": "web", "max_results": 5 }] पास करें — यह OpenAI और Anthropic-संगत API में काम करता है।
अधिकतम रिस्पॉन्स लंबाई 8192 टोकन तक है; max_tokens पैरामीटर को नियंत्रित करें (डिफॉल्ट रूप से स्ट्रीमिंग के लिए 1024 और सामान्य के लिए 1500)।
चैट पेज पर सूची से एक मॉडल चुनें (जो /v1/models से लोड होता है) — चयन सहेजा जाता है और नई बातचीत पर लागू होता है।
क्या गति चाहिए? अनुरोध में x-joingonka-meta: 1 हेडर जोड़ें — स्ट्रीमिंग रिस्पॉन्स में आपको ttft_ms (पहले टोकन तक का समय) और tokens_per_sec मिलेंगे।
एक मैनेजमेंट की (POST /api/management/keys) बनाएँ और POST /api/management/keys/{id}/children के माध्यम से सीमा के साथ (दैनिक और मासिक कोटा, रेट लिमिट, अवधि) चाइल्ड कीज़ जनरेट करें।
किसी प्लगइन को plugins पैरामीटर के साथ कनेक्ट करें: response-healing कटे हुए JSON को ठीक करता है, privacy-sanitization निजी डेटा को मास्क करता है, file-parser PDF और दस्तावेजों से टेक्स्ट निकालता है।
OpenAI: base_url https://gate.joingonka.ai/v1, हेडर Authorization: Bearer आपकी-की। Anthropic (Claude Code): base_url https://gate.joingonka.ai, हेडर x-api-key, endpoint /v1/messages.
GNK: एड्रेस और memo प्राप्त करें और ऑन-चेन टोकन भेजें। USDT: 1 से 10,000 डॉलर तक की राशि निर्दिष्ट करें और OxaPay के माध्यम से भुगतान करें — GNK में रूपांतरण स्वचालित है।