AI एजेंट्स के लिए: सेटअप की चरण-दर-चरण गाइड — /docs/agents.md, दस्तावेज़ इंडेक्स — /llms.txt।
मॉडल
गेटवे के ज़रिए उपलब्ध Gonka नेटवर्क के मॉडल: model फ़ील्ड के लिए पहचानकर्ता, कॉन्टेक्स्ट विंडो, जवाब की सीमा, कीमत और स्थिति।
मॉडल और कीमतें#
मॉडल की सूची Gonka नेटवर्क के वोटिंग से बदलती रहती है, इसलिए यह टेबल गेटवे के लाइव डेटा से बनाई जाती है। कीमतें — GNK के मौजूदा भाव पर प्रति 1M टोकन डॉलर में; कटौती GNK में होती है, अधिक जानकारी प्राइसिंग और अकाउंट अनुभाग में।
| मॉडल | संदर्भ | जवाब | इनपुट, $/1M | आउटपुट, $/1M | स्थिति |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | क्षीण |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | क्षीण |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | कार्यशील |
पहचानकर्ता को model फ़ील्ड में डालें; अक्षरों का केस मायने नहीं रखता। स्थिति सफलतापूर्वक प्रोसेस हुए अनुरोधों के अनुपात से तय होती है, जैसे नेटवर्क स्थिति पेज पर।
मॉडल कैसे चुनें#
- समझ नहीं आ रहा कहाँ से शुरू करें —
MiniMaxAI/MiniMax-M2.7लें: डॉक्यूमेंटेशन के उदाहरण और इंस्टॉलर कमांड इसी के लिए बनाए गए हैं। - सबसे लंबा कॉन्टेक्स्ट —
zai-org/GLM-5.3-Flash: 390K टोकन। बड़े कोडबेस और लंबे डॉक्यूमेंट के लिए। - सबसे लंबा जवाब —
deepseek-ai/DeepSeek-V4-Flash-0731: एक बार में 33K टोकन तक। बड़ी फ़ाइलें पूरी जनरेट करने के लिए।
अगर नेटवर्क किसी मॉडल को सर्व नहीं करता, तो वह GET /v1/models से गायब हो जाता है, और उस पर अनुरोधों को model_unavailable एरर टाइप के साथ 503 मिलता है। एरर टेक्स्ट में वह मॉडल बताया जाएगा जिस पर स्विच किया जा सकता है।
जवाब की लंबाई#
जवाब की लंबाई max_tokens तय करता है — या max_completion_tokens, गेटवे दोनों फ़ील्ड समझता है। हर मॉडल की एक सीमा है: इससे बड़ा max_tokens गेटवे चुपचाप उस तक काट देता है। अगर max_tokens सेट नहीं है, तो stream: true के साथ ऊपरी सीमा लगाई जाती है, और बिना स्ट्रीम के — उससे कम डिफ़ॉल्ट मान।
रीज़निंग वाले मॉडल जवाब से पहले सोचने में max_tokens का हिस्सा खर्च करते हैं — कुछ बफ़र रखें।
model | ऊपरी सीमा | डिफ़ॉल्ट, stream: true | डिफ़ॉल्ट, बिना स्ट्रीम |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
वही संख्याएँ मशीन रूप में — जवाब GET /v1/capabilities, फ़ील्ड limits.models में।
डिफ़ॉल्ट मॉडल#
model फ़ील्ड के बिना आने वाला अनुरोध गेटवे डिफ़ॉल्ट मॉडल को भेजता है — अभी यह MiniMaxAI/MiniMax-M2.7 है।
Claude Code और Anthropic SDK /v1/messages में Anthropic मॉडल नाम (claude-*) भेजते हैं — गेटवे उन्हें उसी डिफ़ॉल्ट मॉडल से बदल देता है।
किसी दूसरे मॉडल के साथ काम करने के लिए ऊपर की टेबल से उसका पहचानकर्ता दें; इंस्टॉलर में यह --model फ़्लैग है।
API से सूची और स्थिति#
मॉडल की सूची Gonka नेटवर्क के वोटिंग से बदलती है — लिस्ट को कोड में हार्डकोड न करें, API से लें। इन अनुरोधों के लिए की की ज़रूरत नहीं है।
| अनुरोध | क्या लौटाता है |
|---|---|
GET /v1/models | अभी उपलब्ध मॉडल: पहचानकर्ता, कॉन्टेक्स्ट, जवाब की सीमा और टोकन की कीमत डॉलर में। जिस मॉडल को नेटवर्क अभी सर्व नहीं करता, वह लिस्ट में नहीं है। |
GET /v1/models/{model} | एक मॉडल उसी फ़ॉर्मैट में। पहचानकर्ता में स्लैश को जैसा है वैसा या %2F के रूप में भेजें। अनजान या छिपा हुआ मॉडल — model_not_found कोड के साथ 404, और छिपे मॉडल पर अनुरोध को 503 model_unavailable मिलता है। |
GET /v1/capabilities | गेटवे की क्षमताएँ: प्रोटोकॉल, अनुरोध पैरामीटर और limits फ़ील्ड — की की अनुरोध सीमा, टाइमआउट और मॉडल के अनुसार max_tokens की ऊपरी सीमाएँ। |
GET /v1/network-status | हर मॉडल की स्थिति और इंसिडेंट — वही डेटा जो नेटवर्क स्थिति पेज पर है। |
GET /health | क्या गेटवे खुद जवाब दे रहा है: {"status":"ok"}। यह अनुरोध मॉडल की स्थिति नहीं जाँचता। |