AI ایجنٹس کے لیے: سیٹ اپ کی مرحلہ وار ہدایات — /docs/agents.md، دستاویزات کا انڈیکس — /llms.txt۔
ماڈلز
گیٹ وے کے ذریعے دستیاب Gonka نیٹ ورک کے ماڈلز: model فیلڈ کے لیے شناخت کنندہ، کانٹیکسٹ ونڈو، جواب کی حد، قیمت اور اسٹیٹس۔
ماڈلز اور قیمتیں#
ماڈلز کی فہرست Gonka نیٹ ورک کے ووٹوں سے بدلتی رہتی ہے، اس لیے ٹیبل گیٹ وے کے لائیو ڈیٹا سے بنتی ہے۔ قیمتیں — GNK کے موجودہ ریٹ پر فی 1M ٹوکنز ڈالر میں؛ کٹوتی GNK میں ہوتی ہے، تفصیل قیمتیں اور اکاؤنٹ سیکشن میں۔
| ماڈل | سیاق و سباق | جواب | ان پٹ، $/1M | آؤٹ پٹ، $/1M | حیثیت |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | خراب |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | خراب |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | آپریشنل |
شناخت کنندہ model فیلڈ میں ڈالیں؛ حروف کے بڑے یا چھوٹے ہونے سے فرق نہیں پڑتا۔ اسٹیٹس کامیاب پروسیس شدہ درخواستوں کے تناسب سے شمار ہوتا ہے، جیسا کہ نیٹ ورک کی حیثیت صفحے پر۔
ماڈل کیسے منتخب کریں#
- سمجھ نہیں آ رہا کہاں سے شروع کریں —
MiniMaxAI/MiniMax-M2.7لیں: ڈاکیومنٹیشن کی مثالیں اور انسٹالر کی کمانڈز اسی کے لیے بنی ہیں۔ - سب سے لمبا کانٹیکسٹ —
zai-org/GLM-5.3-Flash: 390K ٹوکنز۔ بڑے کوڈ بیسز اور طویل دستاویزات کے لیے۔ - سب سے لمبا جواب —
deepseek-ai/DeepSeek-V4-Flash-0731: ایک بار میں 33K ٹوکنز تک۔ بڑی فائلیں مکمل جنریٹ کرنے کے لیے۔
اگر نیٹ ورک کسی ماڈل کی خدمت بند کر دے تو وہ GET /v1/models سے غائب ہو جاتا ہے، اور اس پر درخواستیں 503 جواب بطور ایرر ٹائپ model_unavailable وصول کرتی ہیں۔ ایرر کے متن میں وہ ماڈل ہوگا جس پر سوئچ کیا جا سکتا ہے۔
جواب کی لمبائی#
جواب کی لمبائی max_tokens مقرر کرتا ہے — یا max_completion_tokens، گیٹ وے دونوں فیلڈز سمجھتا ہے۔ ہر ماڈل کی ایک حد ہے: اس سے بڑا max_tokens گیٹ وے خاموشی سے کاٹ کر اس حد تک لے آتا ہے۔ اگر max_tokens نہ دیا جائے تو stream: true میں حد لگ جاتی ہے، اور نان اسٹریم میں — اس سے کم ڈیفالٹ ویلیو۔
ریزننگ ماڈلز جواب سے پہلے سوچنے میں max_tokens کا کچھ حصہ خرچ کرتے ہیں — کچھ بفر رکھیں۔
model | حد | ڈیفالٹ، stream: true | ڈیفالٹ، نان اسٹریم |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
یہی اعداد مشینی شکل میں — GET /v1/capabilities جواب میں، limits.models فیلڈ میں۔
ڈیفالٹ ماڈل#
model فیلڈ کے بغیر درخواست گیٹ وے ڈیفالٹ ماڈل کو بھیجتا ہے — اب یہ MiniMaxAI/MiniMax-M2.7 ہے۔
Claude Code اور Anthropic SDK /v1/messages میں Anthropic ماڈلز کے نام بھیجتے ہیں (claude-*) — گیٹ وے انہیں اسی ڈیفالٹ ماڈل سے بدل دیتا ہے۔
کسی اور ماڈل کے ساتھ کام کرنے کے لیے اوپر دیے گئے ٹیبل سے اس کا شناخت کنندہ دیں؛ انسٹالر میں یہ --model فلیگ ہے۔
API کے ذریعے فہرست اور اسٹیٹس#
ماڈلز کی فہرست Gonka نیٹ ورک کے ووٹوں سے بدلتی رہتی ہے — فہرست کوڈ میں ہارڈ کوڈ نہ کریں، اسے API سے لیں۔ ان درخواستوں کے لیے کلید درکار نہیں۔
| درخواست | کیا واپس کرتا ہے |
|---|---|
GET /v1/models | اس وقت دستیاب ماڈلز: شناخت کنندہ، کانٹیکسٹ، جواب کی حد اور ڈالر میں ٹوکن کی قیمت۔ جو ماڈل نیٹ ورک اس وقت فراہم نہیں کر رہا، وہ فہرست میں نہیں۔ |
GET /v1/models/{model} | ایک ماڈل اسی فارمیٹ میں۔ شناخت کنندہ میں سلیش جوں کا توں یا %2F کے طور پر بھیجیں۔ نامعلوم یا چھپا ہوا ماڈل — 404 کوڈ model_not_found کے ساتھ، اور چھپے ماڈل پر درخواست 503 model_unavailable وصول کرتی ہے۔ |
GET /v1/capabilities | گیٹ وے کی صلاحیتیں: پروٹوکولز، درخواست کے پیرامیٹرز اور limits فیلڈ — کلید کی ریکوٹ لِمٹ، ٹائم آؤٹس اور ماڈل کے لحاظ سے max_tokens کی حدیں۔ |
GET /v1/network-status | ہر ماڈل کا اسٹیٹس اور واقعات — نیٹ ورک کی حیثیت صفحے کا وہی ڈیٹا۔ |
GET /health | کیا گیٹ وے خود جواب دے رہا ہے: {"status":"ok"}۔ یہ درخواست ماڈلز کی حالت کی جانچ نہیں کرتی۔ |