AI ایجنٹس کے لیے: سیٹ اپ کی مرحلہ وار ہدایات — /docs/agents.md، دستاویزات کا انڈیکس — /llms.txt۔

ایررز اور حدود

گیٹ وے کی درخواست کی حدیں، ٹائم آؤٹ اور ایرر کوڈز۔ ہر جواب کے بارے میں بتایا گیا ہے کہ یہ کب پیش آتا ہے اور کیا کرنا ہے: درخواست دہرائیں یا اسے درست کریں۔

حدود#

اعداد GET /v1/capabilities جواب کے limits فیلڈ سے ہیں: وہاں ہمیشہ تازہ ترین ویلیوز ہوتی ہیں۔

حدقدرتجاوز پر
فی کلید فی منٹ درخواستیں120، ونڈو 60 سیکنڈ پہلی درخواست سے429 rate_limit_exceeded اور Retry-After ہیڈر؛ گیٹ وے کی 5xx مستردیاں کوٹہ خرچ نہیں کرتیں
اکاؤنٹ کی بیک وقت درخواستیںمحدودزائد قطار میں انتظار کرتی ہیں؛ انتظار پورا نہ ہو تو — 429 queue_timeout
درخواست باڈی کا سائز16 MiB413
جواب کی لمبائیماڈل کے لحاظ سے — نیچے دیا ٹیبلماڈل کی حد سے بڑا ہو تو — بغیر کسی ایرر کے حد تک کاٹ دیا جاتا ہے
ذیلی کلیدیںفی مینجمنٹ کلید 50 تک، ہر ایک کو فی منٹ 120 درخواستوں تکحدیں بڑھانے کے لیے — سپورٹ کے ذریعے

ماڈل کے لحاظ سے جواب کی لمبائی#

max_tokens کے بغیر گیٹ وے ڈیفالٹ لگاتا ہے: نان اسٹریم میں — کم، تاکہ جواب ٹائم آؤٹس میں سما جائے، اسٹریم میں — ماڈل کی حد۔ max_completion_tokens — وہی فیلڈ۔

modelحدنان اسٹریماسٹریم میں
MiniMaxAI/MiniMax-M2.7819215008192
deepseek-ai/DeepSeek-V4-Flash-073132768150032768
zai-org/GLM-5.3-Flash819230008192

ٹائم آؤٹس#

مرحلہقدرکیا ہوتا ہے
قطار میں جگہ کا انتظار45 سیکنڈRetry-After: 1 ہیڈر کے ساتھ 429 queue_timeout
نیٹ ورک جواب کا آغاز، اسٹریم150 سیکنڈ504 upstream_timeout؛ ان پٹ ٹوکنز کا تخمینہ کاٹ لیا جاتا ہے
نیٹ ورک جواب کا آغاز، نان اسٹریم150 سیکنڈ504 upstream_timeout؛ ان پٹ ٹوکنز کا تخمینہ کاٹ لیا جاتا ہے
جواب کی جنریشن≈ 300 سیکنڈنیٹ ورک جنریشن کاٹ دیتا ہے: جواب finish_reason: length کے ساتھ آتا ہے — اگلی درخواست سے جاری رکھیں
اسٹریم چنکس کے درمیان وقفہ30 سیکنڈاسٹریم بند ہو جاتی ہے: joingonka-stream-stalled چنک میں finish_reason: stop
اسٹریم میں ایکٹیویٹی سگنل15 سیکنڈکمنٹ : keep-alive — SSE کلائنٹس اسے نظر انداز کرتے ہیں
اسٹریم کھولنا30 سیکنڈاس لمحے تک انکار جواب کوڈ کی صورت میں آتا ہے، اس کے بعد — joingonka-error چنک کی صورت میں
نان اسٹریم میں جلد جواب90 سیکنڈگیٹ وے 200 دیتا ہے اور ہر 15 سیکنڈ پر اسپیسز بھیجتا ہے — JSON درست رہتا ہے؛ اس کے بعد ایرر error فیلڈ کے ساتھ باڈی میں آتا ہے، اسٹیٹس 200 رہتا ہے

ٹائم آؤٹ پر کیا کٹتا ہے

نیٹ ورک کی طرف سے قبول شدہ درخواست منسوخ نہیں کی جا سکتی۔ 504 upstream_timeout کی صورت میں ان پٹ ٹوکنز کا تخمینہ کاٹا جاتا ہے، آؤٹ پٹ کا نہیں؛ دوبارہ کوشش نیا کٹوتی ہے۔ حتمی usage سے پہلے منقطع ہونے والی اسٹریم بھی اسی طرح بل کی جاتی ہے۔ طویل جوابات کے لیے stream: true استعمال کریں۔

ایرر کوڈز#

ایرر کا باڈی ایک error آبجیکٹ ہے جس میں message, type, code, param فیلڈز ہوتے ہیں؛ کچھ فیلڈز تمام ایررز میں نہیں ہوتے۔ اسٹیٹس اور type کو بنیاد بنائیں، code سے تصدیق کریں: message متن تبدیل ہو سکتا ہے۔ Anthropic فارمیٹ Anthropic ایرر فارمیٹ سیکشن میں۔

JSON
{
  "error": {
    "message": "Model is currently overloaded in the Gonka network",
    "type": "rate_limit_exceeded",
    "code": "upstream_rate_limited"
  }
}
جوابکبکیا کریں
400 invalid_request_errorغلط باڈی: messages نہیں، پیغام آبجیکٹ نہیں، باڈی JSON نہیں؛ نامعلوم ماڈل — param کے ساتھ: model اور متن میں دستیاب ماڈلز کی فہرستایرر کے متن کے مطابق درخواست درست کریں
400 invalid_request_error empty_content_after_normalizationنارملائزیشن کے بعد پیغام خالی — مثلاً صرف ایک تصویر تھیپیغام میں متن شامل کریں
400 invalid_request_error web_search_privacy_sanitization_not_supportedایک ہی درخواست میں web اور privacy-sanitization پلگ انزان میں سے ایک رکھیں
400 invalid_request_error previous_response_id_not_supported conversation_not_supported item_reference_not_supported background_not_supported hosted_tool_choice_not_supportedOpenAI Responses: محفوظ جواب، گفتگو یا آئٹم کا حوالہ؛ بیک گراؤنڈ موڈ؛ بلٹ اِن ٹول کی ضرورتinput میں مکمل تاریخ بھیجیں
400 api_errorنیٹ ورک نے پیرامیٹرز مسترد کر دیے — مثلاً reasoning_effort کی قدر اس کی فہرست سے باہرایرر کے متن کے مطابق قدر درست کریں
401 authentication_errorکی نہیں ملی، منسوخ یا نامعلوم فارمیٹgate.joingonka.ai/keys صفحے پر کی چیک کریں
402 insufficient_fundsدرخواست کے تخمینے کے لیے بیلنس کافی نہیں؛ باقی — balance_ngonka میںبیلنس ری چارج کریں: gate.joingonka.ai/billing
402 insufficient_fundsسائٹ سے نہ ہونے والی کی کے بغیر درخواست (is_demo: true)API کی پاس کریں
402 child_key_limit_exceededکی کی خرچ کی حد exceeded — روزانہ، ماہانہ یا کل؛ باقی — daily_remaining, monthly_remaining, total_remaining میںgate.joingonka.ai/keys صفحے پر کی کی حد بڑھائیں یا ری سیٹ کا انتظار کریں
403 forbiddenماڈل درخواست میں gm- مینجمنٹ کی؛ کابینہ-صرف روٹ پر API کیدرخواستوں کے لیے — jg- یا gc- کی؛ اکاؤنٹ مینجمنٹ — کابینہ میں
404 invalid_request_error model_not_foundGET /v1/models/{model}: ماڈل کیٹلاگ میں نہیں یا عارضی طور پر چھپا ہواGET /v1/models سے id لیں
404 invalid_request_error not_found compact_not_supportedOpenAI Responses: /v1/responses/{id} اور دیگر اسٹیٹ ایڈریسز، /v1/responses/compactتاریخ اپنے پاس رکھیں؛ Codex CLI کے لیے اپنا پرووائیڈر id سیٹ کریں
404 invalid_request_errorنامعلوم راستہمیتھڈ، راستہ اور بیس ایڈریس چیک کریں
413 invalid_request_errorدرخواست کی باڈی حد سے بڑیدرخواست مختصر کریں
415 invalid_request_errorہیڈر کے مطابق باڈی JSON نہیں: Content-Type: application/json درکارContent-Type: application/json بھیجیں
429 rate_limit_exceededکی فی منٹ درخواستوں کی تعداد exceeded؛ باڈی میں — limit, remaining, reset کے ساتھ rate_limitRetry-After میں جتنے سیکنڈ ہیں اتنا انتظار کریں
429 rate_limit_exceeded upstream_rate_limitedGonka نیٹ ورک پر ماڈل اوورلوڈڈRetry-After کے بعد دوبارہ کوشش کریں یا دوسرا ماڈل لیں — ماڈلز
429 rate_limit_exceeded queue_timeout queue_fullنیٹ ورک کے تمام سلاٹ بھرے ہوئے: قطار بھری یا انتظار ختمRetry-After کے بعد دوبارہ کوشش کریں
500 server_errorگیٹ وے کی اندرونی خرابیبعد میں دوبارہ کوشش کریں؛ بار بار ہو تو سپورٹ کو لکھیں اور x-request-id منسلک کریں
501 not_implementedPOST /v1/embeddings: نیٹ ورک میں کوئی ایمبیڈنگ ماڈل نہیںدوسری ایمبیڈنگ سروس لیں
502 api_error upstream_unauthorizedنیٹ ورک پرووائیڈر نے گیٹ وے کی اسناد مسترد کر دیں — آپ کی کی ٹھیک ہےایک منٹ بعد دوبارہ کوشش کریں
502 api_errorGonka نیٹ ورک کی خرابی؛ code — نیٹ ورک سے، اگر اس نے بھیجا ہووقفے کے ساتھ دوبارہ کوشش کریں یا دوسرا ماڈل لیں
503 model_unavailable model_outage model_initializing model_unstable model_not_servedنیٹ ورک کی پروبز کے مطابق ماڈل اب دستیاب نہیں: خرابی، اسٹارٹ اپ، عدم استحکام یا کوئی اسے سرو نہیں کر رہا؛ انتظار کے بغیر فوری انکاردوسرا ماڈل لیں — ایرر کا متن بتائے گا کون سا؛ فہرست — ماڈلز
503 service_unavailableکوئی نوڈ دستیاب نہیںبعد میں دوبارہ کوشش کریں
504 timeout upstream_timeoutنیٹ ورک نے درخواست قبول کی لیکن وقت پر جواب نہیں دیا؛ ان پٹ ٹوکنز کا تخمینہ کاٹ لیا گیاطویل جوابات کے لیے — stream: true؛ دوبارہ کوشش نیا کٹوتی

کھلی اسٹریم میں ایررز#

جب تک اسٹریم نہیں کھلی، انکار عام رسپانس کوڈ کے طور پر آتا ہے — جیسے اسٹریم کے بغیر۔ کھلنے کے بعد اسٹیٹس پہلے ہی 200 ہے، اور ایرر اس طرح آتا ہے:

  • Chat Completions — error فیلڈ کے ساتھ joingonka-error چنک، پھر [DONE] کے بغیر قطع۔
  • ابتدائی جواب کے بعد اسٹریم کے بغیر — اسٹیٹس 200 اور error فیلڈ کے ساتھ باڈی۔
  • Anthropic Messages — event: error ایونٹ، پھر اسٹریم بند ہو جاتی ہے۔
  • OpenAI Responses — response.failed ایونٹ، وجہ response.error.code میں۔
  • Legacy Completions — data: {"error": …}، پھر [DONE]۔
SSE
data: {"id":"joingonka-error","object":"chat.completion.chunk","model":"MiniMaxAI/MiniMax-M2.7","choices":[],"error":{"message":"Gonka network error","type":"api_error"}}

Anthropic ایرر فارمیٹ#

  • POST /v1/messages Anthropic لفافے میں جواب دیتا ہے: {"type": "error", "error": {"type", "message"}}۔
  • گیٹ وے کے انکار اوپر کی جدول سے type محفوظ رکھتے ہیں (insufficient_funds، model_unavailable اور دیگر)؛ اس لفافے میں code فیلڈ نہیں — وجہ متن میں ہے۔
  • درخواست فارم کی خرابیاں — invalid_request_error: پیغامات یا max_tokens نہیں، نام کے بغیر ٹول کال، نامعلوم ماڈل۔
  • نامعلوم راستہ — not_found_error، بہت بڑی باڈی — request_too_large۔
SSE
event: error
data: {"type":"error","error":{"type":"timeout","message":"Upstream timeout"}}

کیا دوبارہ کریں#

  • Retry-After سے وقفے کے بعد: 429
  • بڑھتے وقفے کے ساتھ — 1، 2، 4 سیکنڈ اور آگے: 500, 502, 503 service_unavailable, 504
  • دوسرے ماڈل کے ساتھ: 503 model_unavailable
  • بغیر تبدیلی دوبارہ نہ کریں — درخواست، کی یا بیلنس درست کریں: 400, 401, 402, 403, 404, 413, 415, 501

504 کے بعد ہر دوبارہ کوشش — ان پٹ تخمینے کی نئی کٹوتی؛ طویل جوابات کے لیے stream: true آن کریں۔

ایرر بار بار ہو تو سپورٹ کو لکھیں اور رسپانس ہیڈرز سے x-request-id منسلک کریں۔