AI एजेंट्स के लिए: सेटअप की चरण-दर-चरण गाइड — /docs/agents.md, दस्तावेज़ इंडेक्स — /llms.txt।

मॉडल

गेटवे के ज़रिए उपलब्ध Gonka नेटवर्क के मॉडल: model फ़ील्ड के लिए पहचानकर्ता, कॉन्टेक्स्ट विंडो, जवाब की सीमा, कीमत और स्थिति।

मॉडल और कीमतें#

मॉडल की सूची Gonka नेटवर्क के वोटिंग से बदलती रहती है, इसलिए यह टेबल गेटवे के लाइव डेटा से बनाई जाती है। कीमतें — GNK के मौजूदा भाव पर प्रति 1M टोकन डॉलर में; कटौती GNK में होती है, अधिक जानकारी प्राइसिंग और अकाउंट अनुभाग में।

मॉडलसंदर्भजवाबइनपुट, $/1Mआउटपुट, $/1Mस्थिति
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025क्षीण
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025क्षीण
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025कार्यशील

पहचानकर्ता को model फ़ील्ड में डालें; अक्षरों का केस मायने नहीं रखता। स्थिति सफलतापूर्वक प्रोसेस हुए अनुरोधों के अनुपात से तय होती है, जैसे नेटवर्क स्थिति पेज पर।

मॉडल कैसे चुनें#

  • समझ नहीं आ रहा कहाँ से शुरू करें — MiniMaxAI/MiniMax-M2.7 लें: डॉक्यूमेंटेशन के उदाहरण और इंस्टॉलर कमांड इसी के लिए बनाए गए हैं।
  • सबसे लंबा कॉन्टेक्स्ट — zai-org/GLM-5.3-Flash: 390K टोकन। बड़े कोडबेस और लंबे डॉक्यूमेंट के लिए।
  • सबसे लंबा जवाब — deepseek-ai/DeepSeek-V4-Flash-0731: एक बार में 33K टोकन तक। बड़ी फ़ाइलें पूरी जनरेट करने के लिए।

अगर नेटवर्क किसी मॉडल को सर्व नहीं करता, तो वह GET /v1/models से गायब हो जाता है, और उस पर अनुरोधों को model_unavailable एरर टाइप के साथ 503 मिलता है। एरर टेक्स्ट में वह मॉडल बताया जाएगा जिस पर स्विच किया जा सकता है।

जवाब की लंबाई#

जवाब की लंबाई max_tokens तय करता है — या max_completion_tokens, गेटवे दोनों फ़ील्ड समझता है। हर मॉडल की एक सीमा है: इससे बड़ा max_tokens गेटवे चुपचाप उस तक काट देता है। अगर max_tokens सेट नहीं है, तो stream: true के साथ ऊपरी सीमा लगाई जाती है, और बिना स्ट्रीम के — उससे कम डिफ़ॉल्ट मान।

रीज़निंग वाले मॉडल जवाब से पहले सोचने में max_tokens का हिस्सा खर्च करते हैं — कुछ बफ़र रखें।

modelऊपरी सीमाडिफ़ॉल्ट, stream: trueडिफ़ॉल्ट, बिना स्ट्रीम
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

वही संख्याएँ मशीन रूप में — जवाब GET /v1/capabilities, फ़ील्ड limits.models में।

डिफ़ॉल्ट मॉडल#

model फ़ील्ड के बिना आने वाला अनुरोध गेटवे डिफ़ॉल्ट मॉडल को भेजता है — अभी यह MiniMaxAI/MiniMax-M2.7 है।

Claude Code और Anthropic SDK /v1/messages में Anthropic मॉडल नाम (claude-*) भेजते हैं — गेटवे उन्हें उसी डिफ़ॉल्ट मॉडल से बदल देता है।

किसी दूसरे मॉडल के साथ काम करने के लिए ऊपर की टेबल से उसका पहचानकर्ता दें; इंस्टॉलर में यह --model फ़्लैग है।

API से सूची और स्थिति#

मॉडल की सूची Gonka नेटवर्क के वोटिंग से बदलती है — लिस्ट को कोड में हार्डकोड न करें, API से लें। इन अनुरोधों के लिए की की ज़रूरत नहीं है।

अनुरोधक्या लौटाता है
GET /v1/modelsअभी उपलब्ध मॉडल: पहचानकर्ता, कॉन्टेक्स्ट, जवाब की सीमा और टोकन की कीमत डॉलर में। जिस मॉडल को नेटवर्क अभी सर्व नहीं करता, वह लिस्ट में नहीं है।
GET /v1/models/{model}एक मॉडल उसी फ़ॉर्मैट में। पहचानकर्ता में स्लैश को जैसा है वैसा या %2F के रूप में भेजें। अनजान या छिपा हुआ मॉडल — model_not_found कोड के साथ 404, और छिपे मॉडल पर अनुरोध को 503 model_unavailable मिलता है।
GET /v1/capabilitiesगेटवे की क्षमताएँ: प्रोटोकॉल, अनुरोध पैरामीटर और limits फ़ील्ड — की की अनुरोध सीमा, टाइमआउट और मॉडल के अनुसार max_tokens की ऊपरी सीमाएँ।
GET /v1/network-statusहर मॉडल की स्थिति और इंसिडेंट — वही डेटा जो नेटवर्क स्थिति पेज पर है।
GET /healthक्या गेटवे खुद जवाब दे रहा है: {"status":"ok"}। यह अनुरोध मॉडल की स्थिति नहीं जाँचता।