> AI एजेंट्स के लिए: सेटअप की चरण-दर-चरण गाइड — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), दस्तावेज़ इंडेक्स — [`/llms.txt`](https://gate.joingonka.ai/llms.txt)।

# मॉडल

गेटवे के ज़रिए उपलब्ध Gonka नेटवर्क के मॉडल: `model` फ़ील्ड के लिए पहचानकर्ता, कॉन्टेक्स्ट विंडो, जवाब की सीमा, कीमत और स्थिति।

## मॉडल और कीमतें

मॉडल की सूची Gonka नेटवर्क के वोटिंग से बदलती रहती है, इसलिए यह टेबल गेटवे के लाइव डेटा से बनाई जाती है। कीमतें — GNK के मौजूदा भाव पर प्रति 1M टोकन डॉलर में; कटौती GNK में होती है, अधिक जानकारी [प्राइसिंग और अकाउंट](https://gate.joingonka.ai/hi/docs/billing) अनुभाग में।

| मॉडल | संदर्भ | जवाब | इनपुट, `$/1M` | आउटपुट, `$/1M` | स्थिति |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | क्षीण |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | क्षीण |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | कार्यशील |

पहचानकर्ता को `model` फ़ील्ड में डालें; अक्षरों का केस मायने नहीं रखता। स्थिति सफलतापूर्वक प्रोसेस हुए अनुरोधों के अनुपात से तय होती है, जैसे [नेटवर्क स्थिति](https://gate.joingonka.ai/hi/status) पेज पर।

## मॉडल कैसे चुनें

- समझ नहीं आ रहा कहाँ से शुरू करें — `MiniMaxAI/MiniMax-M2.7` लें: डॉक्यूमेंटेशन के उदाहरण और इंस्टॉलर कमांड इसी के लिए बनाए गए हैं।
- सबसे लंबा कॉन्टेक्स्ट — `zai-org/GLM-5.3-Flash`: 390K टोकन। बड़े कोडबेस और लंबे डॉक्यूमेंट के लिए।
- सबसे लंबा जवाब — `deepseek-ai/DeepSeek-V4-Flash-0731`: एक बार में 33K टोकन तक। बड़ी फ़ाइलें पूरी जनरेट करने के लिए।

अगर नेटवर्क किसी मॉडल को सर्व नहीं करता, तो वह `GET /v1/models` से गायब हो जाता है, और उस पर अनुरोधों को `model_unavailable` एरर टाइप के साथ 503 मिलता है। एरर टेक्स्ट में वह मॉडल बताया जाएगा जिस पर स्विच किया जा सकता है।

## जवाब की लंबाई

जवाब की लंबाई `max_tokens` तय करता है — या `max_completion_tokens`, गेटवे दोनों फ़ील्ड समझता है। हर मॉडल की एक सीमा है: इससे बड़ा `max_tokens` गेटवे चुपचाप उस तक काट देता है। अगर `max_tokens` सेट नहीं है, तो `stream: true` के साथ ऊपरी सीमा लगाई जाती है, और बिना स्ट्रीम के — उससे कम डिफ़ॉल्ट मान।

रीज़निंग वाले मॉडल जवाब से पहले सोचने में `max_tokens` का हिस्सा खर्च करते हैं — कुछ बफ़र रखें।

| `model` | ऊपरी सीमा | डिफ़ॉल्ट, `stream: true` | डिफ़ॉल्ट, बिना स्ट्रीम |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

वही संख्याएँ मशीन रूप में — जवाब `GET /v1/capabilities`, फ़ील्ड `limits.models` में।

## डिफ़ॉल्ट मॉडल

`model` फ़ील्ड के बिना आने वाला अनुरोध गेटवे डिफ़ॉल्ट मॉडल को भेजता है — अभी यह `MiniMaxAI/MiniMax-M2.7` है।

Claude Code और Anthropic SDK `/v1/messages` में Anthropic मॉडल नाम (`claude-*`) भेजते हैं — गेटवे उन्हें उसी डिफ़ॉल्ट मॉडल से बदल देता है।

किसी दूसरे मॉडल के साथ काम करने के लिए ऊपर की टेबल से उसका पहचानकर्ता दें; इंस्टॉलर में यह `--model` फ़्लैग है।

## API से सूची और स्थिति

मॉडल की सूची Gonka नेटवर्क के वोटिंग से बदलती है — लिस्ट को कोड में हार्डकोड न करें, API से लें। इन अनुरोधों के लिए की की ज़रूरत नहीं है।

| अनुरोध | क्या लौटाता है |
| --- | --- |
| `GET /v1/models` | अभी उपलब्ध मॉडल: पहचानकर्ता, कॉन्टेक्स्ट, जवाब की सीमा और टोकन की कीमत डॉलर में। जिस मॉडल को नेटवर्क अभी सर्व नहीं करता, वह लिस्ट में नहीं है। |
| `GET /v1/models/{model}` | एक मॉडल उसी फ़ॉर्मैट में। पहचानकर्ता में स्लैश को जैसा है वैसा या `%2F` के रूप में भेजें। अनजान या छिपा हुआ मॉडल — `model_not_found` कोड के साथ `404`, और छिपे मॉडल पर अनुरोध को `503 model_unavailable` मिलता है। |
| `GET /v1/capabilities` | गेटवे की क्षमताएँ: प्रोटोकॉल, अनुरोध पैरामीटर और `limits` फ़ील्ड — की की अनुरोध सीमा, टाइमआउट और मॉडल के अनुसार `max_tokens` की ऊपरी सीमाएँ। |
| `GET /v1/network-status` | हर मॉडल की स्थिति और इंसिडेंट — वही डेटा जो [नेटवर्क स्थिति](https://gate.joingonka.ai/hi/status) पेज पर है। |
| `GET /health` | क्या गेटवे खुद जवाब दे रहा है: `{"status":"ok"}`। यह अनुरोध मॉडल की स्थिति नहीं जाँचता। |
