AI ایجنٹس کے لیے: سیٹ اپ کی مرحلہ وار ہدایات — /docs/agents.md، دستاویزات کا انڈیکس — /llms.txt۔

ماڈلز

گیٹ وے کے ذریعے دستیاب Gonka نیٹ ورک کے ماڈلز: model فیلڈ کے لیے شناخت کنندہ، کانٹیکسٹ ونڈو، جواب کی حد، قیمت اور اسٹیٹس۔

ماڈلز اور قیمتیں#

ماڈلز کی فہرست Gonka نیٹ ورک کے ووٹوں سے بدلتی رہتی ہے، اس لیے ٹیبل گیٹ وے کے لائیو ڈیٹا سے بنتی ہے۔ قیمتیں — GNK کے موجودہ ریٹ پر فی 1M ٹوکنز ڈالر میں؛ کٹوتی GNK میں ہوتی ہے، تفصیل قیمتیں اور اکاؤنٹ سیکشن میں۔

ماڈلسیاق و سباقجوابان پٹ، $/1Mآؤٹ پٹ، $/1Mحیثیت
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025خراب
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025خراب
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025آپریشنل

شناخت کنندہ model فیلڈ میں ڈالیں؛ حروف کے بڑے یا چھوٹے ہونے سے فرق نہیں پڑتا۔ اسٹیٹس کامیاب پروسیس شدہ درخواستوں کے تناسب سے شمار ہوتا ہے، جیسا کہ نیٹ ورک کی حیثیت صفحے پر۔

ماڈل کیسے منتخب کریں#

  • سمجھ نہیں آ رہا کہاں سے شروع کریں — MiniMaxAI/MiniMax-M2.7 لیں: ڈاکیومنٹیشن کی مثالیں اور انسٹالر کی کمانڈز اسی کے لیے بنی ہیں۔
  • سب سے لمبا کانٹیکسٹ — zai-org/GLM-5.3-Flash: 390K ٹوکنز۔ بڑے کوڈ بیسز اور طویل دستاویزات کے لیے۔
  • سب سے لمبا جواب — deepseek-ai/DeepSeek-V4-Flash-0731: ایک بار میں 33K ٹوکنز تک۔ بڑی فائلیں مکمل جنریٹ کرنے کے لیے۔

اگر نیٹ ورک کسی ماڈل کی خدمت بند کر دے تو وہ GET /v1/models سے غائب ہو جاتا ہے، اور اس پر درخواستیں 503 جواب بطور ایرر ٹائپ model_unavailable وصول کرتی ہیں۔ ایرر کے متن میں وہ ماڈل ہوگا جس پر سوئچ کیا جا سکتا ہے۔

جواب کی لمبائی#

جواب کی لمبائی max_tokens مقرر کرتا ہے — یا max_completion_tokens، گیٹ وے دونوں فیلڈز سمجھتا ہے۔ ہر ماڈل کی ایک حد ہے: اس سے بڑا max_tokens گیٹ وے خاموشی سے کاٹ کر اس حد تک لے آتا ہے۔ اگر max_tokens نہ دیا جائے تو stream: true میں حد لگ جاتی ہے، اور نان اسٹریم میں — اس سے کم ڈیفالٹ ویلیو۔

ریزننگ ماڈلز جواب سے پہلے سوچنے میں max_tokens کا کچھ حصہ خرچ کرتے ہیں — کچھ بفر رکھیں۔

modelحدڈیفالٹ، stream: trueڈیفالٹ، نان اسٹریم
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

یہی اعداد مشینی شکل میں — GET /v1/capabilities جواب میں، limits.models فیلڈ میں۔

ڈیفالٹ ماڈل#

model فیلڈ کے بغیر درخواست گیٹ وے ڈیفالٹ ماڈل کو بھیجتا ہے — اب یہ MiniMaxAI/MiniMax-M2.7 ہے۔

Claude Code اور Anthropic SDK /v1/messages میں Anthropic ماڈلز کے نام بھیجتے ہیں (claude-*) — گیٹ وے انہیں اسی ڈیفالٹ ماڈل سے بدل دیتا ہے۔

کسی اور ماڈل کے ساتھ کام کرنے کے لیے اوپر دیے گئے ٹیبل سے اس کا شناخت کنندہ دیں؛ انسٹالر میں یہ --model فلیگ ہے۔

API کے ذریعے فہرست اور اسٹیٹس#

ماڈلز کی فہرست Gonka نیٹ ورک کے ووٹوں سے بدلتی رہتی ہے — فہرست کوڈ میں ہارڈ کوڈ نہ کریں، اسے API سے لیں۔ ان درخواستوں کے لیے کلید درکار نہیں۔

درخواستکیا واپس کرتا ہے
GET /v1/modelsاس وقت دستیاب ماڈلز: شناخت کنندہ، کانٹیکسٹ، جواب کی حد اور ڈالر میں ٹوکن کی قیمت۔ جو ماڈل نیٹ ورک اس وقت فراہم نہیں کر رہا، وہ فہرست میں نہیں۔
GET /v1/models/{model}ایک ماڈل اسی فارمیٹ میں۔ شناخت کنندہ میں سلیش جوں کا توں یا %2F کے طور پر بھیجیں۔ نامعلوم یا چھپا ہوا ماڈل — 404 کوڈ model_not_found کے ساتھ، اور چھپے ماڈل پر درخواست 503 model_unavailable وصول کرتی ہے۔
GET /v1/capabilitiesگیٹ وے کی صلاحیتیں: پروٹوکولز، درخواست کے پیرامیٹرز اور limits فیلڈ — کلید کی ریکوٹ لِمٹ، ٹائم آؤٹس اور ماڈل کے لحاظ سے max_tokens کی حدیں۔
GET /v1/network-statusہر ماڈل کا اسٹیٹس اور واقعات — نیٹ ورک کی حیثیت صفحے کا وہی ڈیٹا۔
GET /healthکیا گیٹ وے خود جواب دے رہا ہے: {"status":"ok"}۔ یہ درخواست ماڈلز کی حالت کی جانچ نہیں کرتی۔