> AI ایجنٹس کے لیے: سیٹ اپ کی مرحلہ وار ہدایات — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md)، دستاویزات کا انڈیکس — [`/llms.txt`](https://gate.joingonka.ai/llms.txt)۔

# ماڈلز

گیٹ وے کے ذریعے دستیاب Gonka نیٹ ورک کے ماڈلز: `model` فیلڈ کے لیے شناخت کنندہ، کانٹیکسٹ ونڈو، جواب کی حد، قیمت اور اسٹیٹس۔

## ماڈلز اور قیمتیں

ماڈلز کی فہرست Gonka نیٹ ورک کے ووٹوں سے بدلتی رہتی ہے، اس لیے ٹیبل گیٹ وے کے لائیو ڈیٹا سے بنتی ہے۔ قیمتیں — GNK کے موجودہ ریٹ پر فی 1M ٹوکنز ڈالر میں؛ کٹوتی GNK میں ہوتی ہے، تفصیل [قیمتیں اور اکاؤنٹ](https://gate.joingonka.ai/ur/docs/billing) سیکشن میں۔

| ماڈل | سیاق و سباق | جواب | ان پٹ، `$/1M` | آؤٹ پٹ، `$/1M` | حیثیت |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | خراب |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | خراب |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | آپریشنل |

شناخت کنندہ `model` فیلڈ میں ڈالیں؛ حروف کے بڑے یا چھوٹے ہونے سے فرق نہیں پڑتا۔ اسٹیٹس کامیاب پروسیس شدہ درخواستوں کے تناسب سے شمار ہوتا ہے، جیسا کہ [نیٹ ورک کی حیثیت](https://gate.joingonka.ai/ur/status) صفحے پر۔

## ماڈل کیسے منتخب کریں

- سمجھ نہیں آ رہا کہاں سے شروع کریں — `MiniMaxAI/MiniMax-M2.7` لیں: ڈاکیومنٹیشن کی مثالیں اور انسٹالر کی کمانڈز اسی کے لیے بنی ہیں۔
- سب سے لمبا کانٹیکسٹ — `zai-org/GLM-5.3-Flash`: 390K ٹوکنز۔ بڑے کوڈ بیسز اور طویل دستاویزات کے لیے۔
- سب سے لمبا جواب — `deepseek-ai/DeepSeek-V4-Flash-0731`: ایک بار میں 33K ٹوکنز تک۔ بڑی فائلیں مکمل جنریٹ کرنے کے لیے۔

اگر نیٹ ورک کسی ماڈل کی خدمت بند کر دے تو وہ `GET /v1/models` سے غائب ہو جاتا ہے، اور اس پر درخواستیں 503 جواب بطور ایرر ٹائپ `model_unavailable` وصول کرتی ہیں۔ ایرر کے متن میں وہ ماڈل ہوگا جس پر سوئچ کیا جا سکتا ہے۔

## جواب کی لمبائی

جواب کی لمبائی `max_tokens` مقرر کرتا ہے — یا `max_completion_tokens`، گیٹ وے دونوں فیلڈز سمجھتا ہے۔ ہر ماڈل کی ایک حد ہے: اس سے بڑا `max_tokens` گیٹ وے خاموشی سے کاٹ کر اس حد تک لے آتا ہے۔ اگر `max_tokens` نہ دیا جائے تو `stream: true` میں حد لگ جاتی ہے، اور نان اسٹریم میں — اس سے کم ڈیفالٹ ویلیو۔

ریزننگ ماڈلز جواب سے پہلے سوچنے میں `max_tokens` کا کچھ حصہ خرچ کرتے ہیں — کچھ بفر رکھیں۔

| `model` | حد | ڈیفالٹ، `stream: true` | ڈیفالٹ، نان اسٹریم |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

یہی اعداد مشینی شکل میں — `GET /v1/capabilities` جواب میں، `limits.models` فیلڈ میں۔

## ڈیفالٹ ماڈل

`model` فیلڈ کے بغیر درخواست گیٹ وے ڈیفالٹ ماڈل کو بھیجتا ہے — اب یہ `MiniMaxAI/MiniMax-M2.7` ہے۔

Claude Code اور Anthropic SDK `/v1/messages` میں Anthropic ماڈلز کے نام بھیجتے ہیں (`claude-*`) — گیٹ وے انہیں اسی ڈیفالٹ ماڈل سے بدل دیتا ہے۔

کسی اور ماڈل کے ساتھ کام کرنے کے لیے اوپر دیے گئے ٹیبل سے اس کا شناخت کنندہ دیں؛ انسٹالر میں یہ `--model` فلیگ ہے۔

## API کے ذریعے فہرست اور اسٹیٹس

ماڈلز کی فہرست Gonka نیٹ ورک کے ووٹوں سے بدلتی رہتی ہے — فہرست کوڈ میں ہارڈ کوڈ نہ کریں، اسے API سے لیں۔ ان درخواستوں کے لیے کلید درکار نہیں۔

| درخواست | کیا واپس کرتا ہے |
| --- | --- |
| `GET /v1/models` | اس وقت دستیاب ماڈلز: شناخت کنندہ، کانٹیکسٹ، جواب کی حد اور ڈالر میں ٹوکن کی قیمت۔ جو ماڈل نیٹ ورک اس وقت فراہم نہیں کر رہا، وہ فہرست میں نہیں۔ |
| `GET /v1/models/{model}` | ایک ماڈل اسی فارمیٹ میں۔ شناخت کنندہ میں سلیش جوں کا توں یا `%2F` کے طور پر بھیجیں۔ نامعلوم یا چھپا ہوا ماڈل — `404` کوڈ `model_not_found` کے ساتھ، اور چھپے ماڈل پر درخواست `503 model_unavailable` وصول کرتی ہے۔ |
| `GET /v1/capabilities` | گیٹ وے کی صلاحیتیں: پروٹوکولز، درخواست کے پیرامیٹرز اور `limits` فیلڈ — کلید کی ریکوٹ لِمٹ، ٹائم آؤٹس اور ماڈل کے لحاظ سے `max_tokens` کی حدیں۔ |
| `GET /v1/network-status` | ہر ماڈل کا اسٹیٹس اور واقعات — [نیٹ ورک کی حیثیت](https://gate.joingonka.ai/ur/status) صفحے کا وہی ڈیٹا۔ |
| `GET /health` | کیا گیٹ وے خود جواب دے رہا ہے: `{"status":"ok"}`۔ یہ درخواست ماڈلز کی حالت کی جانچ نہیں کرتی۔ |
